{"as_of":"2026-08-19T09:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:42607743106b43dbfd8a16456b49b77bb7bbf3df0abcb00a9fa3e36856b060c6","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:36:04.327416Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T03:04:14.900791Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T12:46:04.847216Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.19697","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.19697","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.19697 , year=","venue":null,"work_id":"9b62e547-d8a5-40b4-87fc-9cec7c42a16f","year":null},"citing_paper":{"arxiv_id":"2604.19167","last_updated":"2026-04-21T07:25:02Z","snapshot_observed_at":"2026-08-17T07:57:13.029023Z","submitted_at":"2026-04-21T07:25:02Z","title":"LBLLM: Lightweight Binarization of Large Language Models via Three-Stage Distillation","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-10T03:04:14.900791Z"},"links":{"cited_paper":"/paper/2506.19697","citing_paper":"/paper/2604.19167"},"observation_digest":"sha256:a48404df7e076d6c76c889842ae5365443d5a02df813c7f755bd0a4eb843fb6b","observation_id":"7dff8f52-bdcc-4183-a503-95be16326748","resolution":{"observed_at":"2026-05-11T12:46:04.850037Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.19697/citation-record","integrity":"/paper/2506.19697/integrity","json":"/paper/2506.19697/citation-record.json","paper":"/paper/2506.19697"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-08-14T05:03:05.661970Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-08-15T18:36:03.926620Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:03.926620Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:7f599f368c15e9afa24410dc0505c82f896770e2aa60957b2e8e592bb0d80e8e","observation_id":"9b65b8b8-2f66-4185-8ad9-b67de9da4779","resolution":{"observed_at":"2026-08-15T18:36:03.926620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:03.933712Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:03.933712Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:827861f0a163b0b31a0960b44d1b8f37062410e00c2587b52e4df9fcd9c21dac","observation_id":"81c310f7-1b1a-4d20-925a-0079fe52616c","resolution":{"observed_at":"2026-08-15T18:36:03.933712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.446641Z","title":"Croci, Marcelo Gennari do Nascimento, Torsten Hoefler, and James Hensman","venue":null,"work_id":"ac81fbb1-01e7-4abd-ac61-15f11d2b76fa","year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:03.940104Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:449648e989eeb39250a7e011472e077f24cdbc109c7d7b85f94aae5de9c36cfa","observation_id":"f2bcbefe-e207-4509-8608-902b5b2445ad","resolution":{"observed_at":"2026-08-15T18:36:05.451398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.430057Z","title":null,"venue":null,"work_id":"df7e3af3-5e3d-4804-aa69-fa336ad138c3","year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:03.946340Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:1aceb84a510fdd941f2f0f7c423d69fd8ebd501aad98e9ad4a7807fefd7abee2","observation_id":"d21779f4-7c48-4e6c-96a2-6fdcc16e5830","resolution":{"observed_at":"2026-08-15T18:36:05.435535Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-15T18:36:03.952135Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:03.952135Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:1cdad23a62cdfb18629a34d1d5cbdd4d2adf7d498416d1b16abffa00c9fcee07","observation_id":"a8e8b697-7a5a-45df-a2fb-feedc87d574f","resolution":{"observed_at":"2026-08-15T18:36:03.952135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02732","last_updated":"2025-08-05T16:43:21Z","snapshot_observed_at":"2026-08-16T12:44:12.305500Z","submitted_at":"2025-04-03T16:17:55Z","title":"Why do LLMs attend to the first token?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02732","snapshot_observed_at":"2026-08-15T18:36:03.958061Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:03.958061Z"},"links":{"cited_paper":"/paper/2504.02732","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:93ce896ad89c15e0cecadf1460cd75901abb03b345753b9693af98f57fdc6f8e","observation_id":"728f8fc5-3d0e-4969-8f6c-02771a0c3626","resolution":{"observed_at":"2026-08-15T18:36:03.958061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17834","last_updated":"2024-02-27T19:00:07Z","snapshot_observed_at":"2026-08-16T14:14:46.903233Z","submitted_at":"2024-02-27T19:00:07Z","title":"Stable LM 2 1.6B Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17834","snapshot_observed_at":"2026-08-15T18:36:03.965294Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:03.965294Z"},"links":{"cited_paper":"/paper/2402.17834","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:782954cddd121baf2d1bf1cadd3f45da8cb14ac5b5d30ff3ad6ef3c16b8409bd","observation_id":"e3e79822-2eea-4b0a-95dc-96b90e14eb3b","resolution":{"observed_at":"2026-08-15T18:36:03.965294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:03.970857Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:03.970857Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:17c217a90178491e00acfaa68b888181fc691fb00071db8743968128bc40fc80","observation_id":"68e97bec-a666-423c-a9c9-05765337d156","resolution":{"observed_at":"2026-08-15T18:36:03.970857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-16T13:05:17.001660Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-08-15T18:36:03.975857Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:03.975857Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:c4bcfa735078dc9f3a61583a7b89232a003fea441da19b275faedfec8fb9da49","observation_id":"73cc3440-e0de-43e7-b254-d8501c99a660","resolution":{"observed_at":"2026-08-15T18:36:03.975857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20325","last_updated":"2024-12-06T14:09:22Z","snapshot_observed_at":"2026-08-12T12:26:45.359430Z","submitted_at":"2024-09-30T14:26:12Z","title":"Old Optimizer, New Norm: An Anthology","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20325","snapshot_observed_at":"2026-08-15T18:36:03.981896Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:03.981896Z"},"links":{"cited_paper":"/paper/2409.20325","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:9a108cf00c3dedd858135c8d4a93a22c90ddc21e08e434e477de541e6fdf8451","observation_id":"ed4bf963-ecd2-449b-bc14-06c6c00a7e6f","resolution":{"observed_at":"2026-08-15T18:36:03.981896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:03.992611Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:03.992611Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:6c1c139b932806d2ee92e7692416c50809e8d8cb8332b38ff1d09896270018fe","observation_id":"b0a9cc88-9601-4a8a-8260-438dabc5f588","resolution":{"observed_at":"2026-08-15T18:36:03.992611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:03.999175Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:03.999175Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:ca17de6ac0fd208cc5c457ef35f02bfc2fee1570ccfb4bcf546fc351ff2712e4","observation_id":"88d71ad2-977f-4ff1-8a6e-f51f849d081a","resolution":{"observed_at":"2026-08-15T18:36:03.999175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.005186Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.005186Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:e8b4dbb3fe98d512ec3678dab3900a258d906a4c057fb1dbab4e1a0bb6719984","observation_id":"5e689e36-eb04-4feb-afde-42c1fbdceeee","resolution":{"observed_at":"2026-08-15T18:36:04.005186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.396481Z","title":null,"venue":null,"work_id":"ebf2d4b2-b287-42aa-8cab-4c73c6b133d6","year":2023},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.013077Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:7987163510175ed00eb2db7b6af20a92f4ad1e99fe80fde3907dbac71451ba81","observation_id":"73cc8c8e-c4d0-4b24-a189-eb75c1d0b6f7","resolution":{"observed_at":"2026-08-15T18:36:05.400941Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.380498Z","title":null,"venue":null,"work_id":"c7eaa3fc-7ccf-4251-a77d-efaa0bd8a64b","year":2018},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.017978Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:dadbd832f52088f12abe688f9f2f49f63ad1a61e0c525e862f37be2bbc82be5c","observation_id":"3450e73f-8ebf-4de7-bfa8-af7296ecdac4","resolution":{"observed_at":"2026-08-15T18:36:05.385682Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.364059Z","title":null,"venue":null,"work_id":"e5a5018e-642b-452b-ab99-87294262c04d","year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.024067Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:9847f2916718228c674f655477f6947cba9053633160e95db133b22729bed4a3","observation_id":"fc6b482b-2542-43d9-b69a-668d20399925","resolution":{"observed_at":"2026-08-15T18:36:05.369436Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.346742Z","title":null,"venue":null,"work_id":"35b8a2b7-a112-47d8-beaf-22a050033588","year":2023},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.030731Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:09d043de93bf55782542e54a116d7b1fb548c4bafce2e3a8b62f50c8c0af7d39","observation_id":"d40b9fea-78f1-498a-8275-a9ae69e17190","resolution":{"observed_at":"2026-08-15T18:36:05.352198Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11062","last_updated":"2025-05-19T06:20:01Z","snapshot_observed_at":"2026-08-16T13:35:20.246215Z","submitted_at":"2024-07-10T17:53:30Z","title":"EfficientQAT: Efficient Quantization-Aware Training for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11062","snapshot_observed_at":"2026-08-15T18:36:04.036223Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.036223Z"},"links":{"cited_paper":"/paper/2407.11062","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:6acd8859391695b4617e1dd8914210ebbd9ad2cc55386f3181ecab2615b2f39b","observation_id":"8a58d41a-9098-42cb-89ab-0ba8579d5c6a","resolution":{"observed_at":"2026-08-15T18:36:04.036223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16886","last_updated":"2023-12-30T04:59:21Z","snapshot_observed_at":"2026-07-29T22:12:01.108911Z","submitted_at":"2023-12-28T08:21:24Z","title":"MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16886","snapshot_observed_at":"2026-08-15T18:36:04.043337Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.043337Z"},"links":{"cited_paper":"/paper/2312.16886","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:ce20334f2baf55abc5175f60aff296eddde4a96c28f846f87046f8470367892a","observation_id":"920da0cb-01c1-4742-87b7-0423c9ac872f","resolution":{"observed_at":"2026-08-15T18:36:04.043337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-15T18:36:04.049093Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.049093Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:d083988962109d2848957fd5e6890faa4603c143a98ffe760e177ade97712531","observation_id":"6e09c3d8-965e-49a9-8c36-444f0252a5ca","resolution":{"observed_at":"2026-08-15T18:36:04.049093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T18:36:04.055640Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.055640Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:81ab4e009ce154dba785f6a52e109b47f8858c678f0f949259a75f38c2ae26ec","observation_id":"4b2d89cc-937a-48bd-965a-2e6979ded353","resolution":{"observed_at":"2026-08-15T18:36:04.055640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.061544Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.061544Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:f7bfcf9118513cb8abd17bceab0db202aa773db6673e277a2b60f70546f86073","observation_id":"303559b7-5c05-47d9-9dce-ded671794dbe","resolution":{"observed_at":"2026-08-15T18:36:04.061544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T18:36:04.068069Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.068069Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:6f360d5759dfaacf6ebfba8ee998e611e77daa1adf2405b6f808337ba8d1df60","observation_id":"807d3e24-4684-4308-922b-4e4632fe61d9","resolution":{"observed_at":"2026-08-15T18:36:04.068069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.314767Z","title":null,"venue":null,"work_id":"50b11c45-ccca-4f88-82f9-fe9103877ffb","year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.075022Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:54560c6566e9cceabf3af28496d31bee063cf6380c22f618206fafab8c615cb7","observation_id":"252bdf39-286e-496c-a252-eb6e530ebd05","resolution":{"observed_at":"2026-08-15T18:36:05.321232Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.299196Z","title":null,"venue":null,"work_id":"08848ca0-f79a-4bee-adce-caee4cd44149","year":2023},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.081101Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:010f32f4c6e30332a3279639dbab727487b213c5a170b8267f9414791d170a8d","observation_id":"ae11edcc-d722-43ed-863e-94f47c54bfa1","resolution":{"observed_at":"2026-08-15T18:36:05.304576Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.085951Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.085951Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:f0c98841016698c54e20a14e0d40bb312033a5faa3c0737fa338a151d81c2a9c","observation_id":"04f8ce21-1e63-42ca-8694-6f878d089d12","resolution":{"observed_at":"2026-08-15T18:36:04.085951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.091931Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.091931Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:3efdeb75a915cd7a78e76d86175f41d1926a6e66a3deccceabf5a491fb7f55e7","observation_id":"3121996d-8c65-4b1c-bc77-75486c9489c6","resolution":{"observed_at":"2026-08-15T18:36:04.091931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.097301Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.097301Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:be4ca4232705864bdc97fb1f6d5be2de7554a7d7145b5e02455cd96efdbf8c41","observation_id":"8ce998ad-951b-4d9f-90e4-5744c7c98a26","resolution":{"observed_at":"2026-08-15T18:36:04.097301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13835","last_updated":"2024-11-07T16:57:02Z","snapshot_observed_at":"2026-08-16T13:08:17.891031Z","submitted_at":"2024-10-17T17:54:06Z","title":"Active-Dormant Attention Heads: Mechanistically Demystifying Extreme-Token Phenomena in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13835","snapshot_observed_at":"2026-08-15T18:36:04.105142Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.105142Z"},"links":{"cited_paper":"/paper/2410.13835","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:83c20d20fb2c19f3ed53d68b24450bd1657a5a0ce35ba02158461e97a81b3db7","observation_id":"aefffdbe-a479-4736-b1c2-ef40f138775f","resolution":{"observed_at":"2026-08-15T18:36:04.105142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.253517Z","title":null,"venue":null,"work_id":"2f299553-0041-403f-a94f-837d1ebfba69","year":2018},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.110540Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:7d32fd8fae60835dccb811f73b86f47287e4587c320769ec360856e48d5e1fa8","observation_id":"91bd92e3-0241-4dde-a2d3-d6e2dcb4a346","resolution":{"observed_at":"2026-08-15T18:36:05.259387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.236696Z","title":null,"venue":null,"work_id":"939ff36d-464d-4a50-a8fb-75ca0c3e40ae","year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.115403Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:af9cbced898f6a7ff79e5a6d90bc6b35b4c586f112956d2eb2181440b56c6968","observation_id":"3571effc-8076-483f-ba22-79e5e8af4ad7","resolution":{"observed_at":"2026-08-15T18:36:05.241600Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.216943Z","title":null,"venue":null,"work_id":"b134e20d-5ce5-4193-8d88-113ec7f54bf8","year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.120986Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:666dbf43497c0eec5d15128e6ac2f179b437553234311856f1e18d0130eae7ce","observation_id":"5db92621-9138-49a2-9679-0826e2a90873","resolution":{"observed_at":"2026-08-15T18:36:05.224507Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.126010Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.126010Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:51627c30be3abca0a6a6f02443ba44dfa4d4f42c99483492b5bf2da91e6a888f","observation_id":"1e2d2cd8-6795-40b6-995a-aa97c7a20c6d","resolution":{"observed_at":"2026-08-15T18:36:04.126010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.187350Z","title":null,"venue":null,"work_id":"1d3ad0f0-8ee7-4dbb-8885-9dd2e89fa4a4","year":2008},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.130533Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:403ecfef8e78d47dda0185c7b93885f537fa73e1ae582367877ccf54a1ff57b0","observation_id":"2646a602-81a4-41fd-8b35-d0bcf7982fbe","resolution":{"observed_at":"2026-08-15T18:36:05.192689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.170287Z","title":null,"venue":null,"work_id":"21c9c9c9-f013-47f9-966e-d3c853d6424a","year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.135853Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:40c57b5f6ecf796a7a61f8bd447c1debc1afefbf768a3cbbf572b996d2d2cf6a","observation_id":"d1fd153a-2160-403f-a26e-322a331d90f8","resolution":{"observed_at":"2026-08-15T18:36:05.175949Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.141723Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.141723Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:68ed29cd0083183fcbbd2634495eecdaa98588837670d722ab7f3f54b49389ed","observation_id":"ec8eb11e-59df-4cac-a17e-3076e34b2935","resolution":{"observed_at":"2026-08-15T18:36:04.141723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.154537Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":"0d7a5d73-639a-4235-94a5-1c3098262b38","year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.147780Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:71c64510bb3e66b8068ec76358c62c4f5fc20f562a156d796de99174cca607c4","observation_id":"8d38c56a-fca6-4e4a-a621-1549a89a2072","resolution":{"observed_at":"2026-08-15T18:36:05.159661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.153187Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.153187Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:f8c66a6e17d7a55ce37953977721f0c7ebe4193d655a3c9b60e60bea7896d2d2","observation_id":"c8583787-1f40-4ae8-9cdf-a864bd586497","resolution":{"observed_at":"2026-08-15T18:36:04.153187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06161","last_updated":"2023-12-13T14:44:10Z","snapshot_observed_at":"2026-07-06T15:25:35.930688Z","submitted_at":"2023-05-09T08:16:42Z","title":"StarCoder: may the source be with you!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06161","snapshot_observed_at":"2026-08-15T18:36:04.159406Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.159406Z"},"links":{"cited_paper":"/paper/2305.06161","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:1fc0e613ca1d119010cbf834a729abc0351b7944011ad9547971b805b00dce94","observation_id":"2d1db440-73ac-4d4a-a70c-251062ec9297","resolution":{"observed_at":"2026-08-15T18:36:04.159406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.165418Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.165418Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:3b93093ede21b61b7391c6f5b7c3ca1a76888d74279b380be28e6b2917c7bef0","observation_id":"bbe5f2e1-34a5-4428-ab14-a941acee1c5f","resolution":{"observed_at":"2026-08-15T18:36:04.165418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.170471Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.170471Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:bd58abb82218a9d005e45a82a8860d8e2aa4c8fa37ec2a0363c0d49c1a70bb3d","observation_id":"9be52e92-5590-4485-a7ee-0d76e28d2586","resolution":{"observed_at":"2026-08-15T18:36:04.170471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.176059Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.176059Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:227f42f828cd437847f2ec42274f500bc9e3f6afe6fc63432e11e69865fa50da","observation_id":"9f2ee6c5-ea4b-4999-b7ad-801fdc3778a0","resolution":{"observed_at":"2026-08-15T18:36:04.176059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-08-16T17:18:05.876361Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16406","snapshot_observed_at":"2026-08-15T18:36:04.181059Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.181059Z"},"links":{"cited_paper":"/paper/2405.16406","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:bd39f39ce0f68e60cb0be4cf6e43771a699b606702487ab739cabec59cea6c6f","observation_id":"035003fd-ad07-451c-8c52-04e7ef4c015c","resolution":{"observed_at":"2026-08-15T18:36:04.181059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.186098Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.186098Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:e1088cceac7aee5c9051cc2a3c05233bd0fa3b8ecf0dbef87c224ab2ba27ba75","observation_id":"8c39fc08-4060-4973-8353-d1d12e8fa5fd","resolution":{"observed_at":"2026-08-15T18:36:04.186098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.122297Z","title":null,"venue":null,"work_id":"de095226-0b9b-4cb3-a198-11f8413a6bc5","year":2015},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.190772Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:1540da0fbe607f35b01b8d8b43e71977e4219e37edab541cf51892bf852908ab","observation_id":"aeb0639b-5d00-403f-9e8d-3a5ebd66cd3a","resolution":{"observed_at":"2026-08-15T18:36:05.128023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-08-17T01:46:43.513643Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-15T18:36:04.196076Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.196076Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:42927a5f8fdb6ed811540edffa767c4db456e548e687f24373684a647aef22a6","observation_id":"a95b9dcd-2f63-4c7b-8ec1-690828ca933f","resolution":{"observed_at":"2026-08-15T18:36:04.196076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.201097Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.201097Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:d13cf5caad560ae317abfe23185b08116fc8966187cb620d324602604e060032","observation_id":"5becfd23-d704-4df3-95d7-cce05cfd5d6b","resolution":{"observed_at":"2026-08-15T18:36:04.201097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03605","last_updated":"2024-08-26T20:48:19Z","snapshot_observed_at":"2026-08-19T07:04:18.091000Z","submitted_at":"2024-04-04T17:25:30Z","title":"Mitigating the Impact of Outlier Channels for Language Model Quantization with Activation Regularization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03605","snapshot_observed_at":"2026-08-15T18:36:04.206296Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.206296Z"},"links":{"cited_paper":"/paper/2404.03605","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:eb2c112ef19c7cb1184c6ed0f6b6b0e3c9f039e3519036265bc4d449b04336cd","observation_id":"e44df9df-b92a-4b85-988a-e075da2b6b73","resolution":{"observed_at":"2026-08-15T18:36:04.206296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.14995","last_updated":"2024-01-19T07:47:01Z","snapshot_observed_at":"2026-08-16T15:12:45.594763Z","submitted_at":"2023-07-27T16:45:33Z","title":"TransNormerLLM: A Faster and Better Large Language Model with Improved TransNormer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.14995","snapshot_observed_at":"2026-08-15T18:36:04.211038Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.211038Z"},"links":{"cited_paper":"/paper/2307.14995","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:bd4f595f564f86f28116aa32a30337a68230699f721c0627a10edc9ade77734c","observation_id":"3329b712-8782-4798-8cca-c4e83558bfc3","resolution":{"observed_at":"2026-08-15T18:36:04.211038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.215990Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.215990Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:d9a352f75483bf725fdf262beff08634174da458b12686db87d5e6bbcc698382","observation_id":"b8bc45d0-7b58-46af-b9ef-a60733ee7c14","resolution":{"observed_at":"2026-08-15T18:36:04.215990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.221595Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.221595Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:27455bca7b048ce15ab8db3fdf1c26d8a6f497f9f54bb5d2c107ef532e5d1ef1","observation_id":"d140faee-26a9-43bb-9232-49bb1a645e45","resolution":{"observed_at":"2026-08-15T18:36:04.221595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.102517Z","title":"u nther Schulz. 1933. Iterative berechung der reziproken matrix. ZAMM-Journal of Applied Mathematics and Mechanics/Zeitschrift f \\","venue":null,"work_id":"aa6e8b8e-0109-4d0c-831d-86723542d284","year":1933},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.226578Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:8b5e0fddb961a6ba4349c68198cf9bf084c6332471981bc0f3586d984a16e58e","observation_id":"7d8ef469-0712-4a12-bde1-52928ced3e57","resolution":{"observed_at":"2026-08-15T18:36:05.109924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.134","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.395867Z","title":null,"venue":null,"work_id":"e81c9925-6eb5-4ba2-9dea-5c5386d2ca9a","year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.231054Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:86a89f6e501815f75634ba91bab7ad61929aebf73bb165c63ad1081d12c00852","observation_id":"55259dd1-306c-4743-9bcd-2e8094be5781","resolution":{"observed_at":"2026-08-15T18:36:04.402593Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17762","last_updated":"2024-08-14T16:00:49Z","snapshot_observed_at":"2026-08-16T07:45:21.406264Z","submitted_at":"2024-02-27T18:55:17Z","title":"Massive Activations in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17762","snapshot_observed_at":"2026-08-15T18:36:04.236333Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.236333Z"},"links":{"cited_paper":"/paper/2402.17762","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:cfbffc5a0802be6149e3692b2f0dda64280516f424558a17c19ac3d8d80ad598","observation_id":"2e1d3a8a-d15c-409d-bba9-fc01f777ec28","resolution":{"observed_at":"2026-08-15T18:36:04.236333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.241831Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.241831Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:9e290c0f4853c236c704086ca2f178034fb63c2a33e7df9226f4533180efa6cb","observation_id":"24ac61fd-df23-4832-9290-6314dad64bfe","resolution":{"observed_at":"2026-08-15T18:36:04.241831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-15T18:36:04.247251Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.247251Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:cdccf86edff2bab12a45c9c5bc34f24af81a2d2ad350f1d467de2c1bd310ca99","observation_id":"f5970f24-8f6f-40da-a892-e32e4c2582f3","resolution":{"observed_at":"2026-08-15T18:36:04.247251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.085240Z","title":null,"venue":null,"work_id":"d9646316-7e67-476e-b31b-03d4e2594b23","year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.252067Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:e72c786b138da37f17e30ccb96b93595481bd6c3b6db1f6d9c8e737d01d9dc94","observation_id":"aa9f4a51-81c9-490d-afa8-348f13aba5e9","resolution":{"observed_at":"2026-08-15T18:36:05.089660Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11321","last_updated":"2025-01-31T18:52:42Z","snapshot_observed_at":"2026-08-15T04:58:58.957938Z","submitted_at":"2024-09-17T16:18:05Z","title":"SOAP: Improving and Stabilizing Shampoo using Adam","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11321","snapshot_observed_at":"2026-08-15T18:36:04.257890Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.257890Z"},"links":{"cited_paper":"/paper/2409.11321","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:9133b7b1968aa824bc473b5310ec6bdf0e607f2de3e18ac5835e2d4485abf1f6","observation_id":"6c50cc3f-75dc-46c5-9c5e-1e7906589fd3","resolution":{"observed_at":"2026-08-15T18:36:04.257890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.064875Z","title":null,"venue":null,"work_id":"7de57168-0951-4247-9723-0e9d8cb05b60","year":2022},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.263624Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:80483bfc70e5cfbc84823a27f2d13d3187c2c8cbf08a8b774f4de808253cc1a8","observation_id":"371c906c-6eca-4216-b0ee-7cfd8b96ab3d","resolution":{"observed_at":"2026-08-15T18:36:05.073391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05192","last_updated":"2024-12-02T21:54:54Z","snapshot_observed_at":"2026-08-18T19:10:29.464364Z","submitted_at":"2024-10-07T16:49:39Z","title":"Understanding Warmup-Stable-Decay Learning Rates: A River Valley Loss Landscape Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05192","snapshot_observed_at":"2026-08-15T18:36:04.268397Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.268397Z"},"links":{"cited_paper":"/paper/2410.05192","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:098277c5603da43e1064ec81782d99efb3db4a75c7fc12e075714f3f9338ff69","observation_id":"d95fa228-c6c9-4e26-b901-396b2682b23d","resolution":{"observed_at":"2026-08-15T18:36:04.268397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:05.044216Z","title":null,"venue":null,"work_id":"c39b1ad1-c757-405b-9f1b-f1c00ce31381","year":2023},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.273602Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:5c7dbdaa24f0f5625c33a230fb4a3290fdc58a30cfa7b04a3839de89fb94846e","observation_id":"ab42bd7c-de26-4079-97c9-ee1a70fc6830","resolution":{"observed_at":"2026-08-15T18:36:05.050500Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.277910Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.277910Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:4a5f496d8dad3c7685359b7b59d0f6b821822d139b2bba191b676215e07ec48c","observation_id":"37a13dbf-344e-4127-becb-74a9680ba388","resolution":{"observed_at":"2026-08-15T18:36:04.277910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.13336","last_updated":"2020-04-28T07:13:50Z","snapshot_observed_at":"2026-08-13T06:09:17.589581Z","submitted_at":"2020-04-28T07:13:50Z","title":"Automatic Cross-Replica Sharding of Weight Update in Data-Parallel Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.13336","snapshot_observed_at":"2026-08-15T18:36:04.283742Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.283742Z"},"links":{"cited_paper":"/paper/2004.13336","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:0fbea0f516bad5ec6642d9ead4a03614085e641944e1a786adaf1232fed18992","observation_id":"f2fb500d-eab9-43e2-a914-b8987900ce91","resolution":{"observed_at":"2026-08-15T18:36:04.283742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-15T18:36:04.289531Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.289531Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:013ae5bd7121269d725cd2aecb04429b5980868940fee3d59876912bc5ea11a9","observation_id":"3fc3430a-f333-4225-ae76-94c2075598f0","resolution":{"observed_at":"2026-08-15T18:36:04.289531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-15T18:36:04.294167Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.294167Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:30b4759ea7ae44e4e1a0e74905e862dd2c24e70981c82f0bf8fbedfcfcf1add4","observation_id":"88e95664-f2e8-4711-b567-7b3a506c45a3","resolution":{"observed_at":"2026-08-15T18:36:04.294167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.299886Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.299886Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:e8b4659b76eb6627b97acf448f21eecdd4e8eaf45d063ea3af7c7c0f9ea71fdb","observation_id":"55cd4cd5-bd41-4e6f-9aff-5d8ad495b331","resolution":{"observed_at":"2026-08-15T18:36:04.299886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-15T18:36:04.305001Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.305001Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:d65c56b3f0a9f99278bc462f845454000a3fe5ec4f77265750e05c72c3894d4a","observation_id":"f45f5ba9-5e88-49b4-bf16-3b80915212ca","resolution":{"observed_at":"2026-08-15T18:36:04.305001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-15T18:36:04.309940Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.309940Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:cacfeb38a9ce0ccf6bdab19c15ef69017b446344bc3d570a1d3633ef97a83940","observation_id":"b88ba91f-3096-4e4f-bb49-15c2a2178d78","resolution":{"observed_at":"2026-08-15T18:36:04.309940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.316836Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.316836Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:883f6407ef5420b4d2c1272f7599dd385b97d014638bf2258404c63ddf8a7302","observation_id":"af3e40ec-fa1d-42b1-a5e4-4cb386dba0b7","resolution":{"observed_at":"2026-08-15T18:36:04.316836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:04.327416Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:04.327416Z"},"links":{"citing_paper":"/paper/2506.19697"},"observation_digest":"sha256:3c5154396fa964e53fffbc3af455dd9a84786f9306a4a393efe43549cdede3e6","observation_id":"5560474f-ec75-4ba8-86a0-231fbeb6079e","resolution":{"observed_at":"2026-08-15T18:36:04.327416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.19697","last_updated":"2025-06-24T15:03:57Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T01:19:15.095271Z","submitted_at":"2025-06-24T15:03:57Z","title":"Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":66,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 1 inbound Pith citation observation for arXiv:2506.19697."}