{"as_of":"2026-08-18T05:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7f99104cc8974735eebc6a013eaaab5802d672d4dc3677a0dc1c23d6804cbcb9","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:07:15.153580Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:54:30.816676Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T10:54:31.239932Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.19821","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.19821","snapshot_observed_at":"2026-08-05T10:54:31.239932Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","venue":"cs.AR","work_id":"7550d691-3612-4b78-a183-14f645f9ab0b","year":2024},"citing_paper":{"arxiv_id":"2608.03867","last_updated":"2026-08-04T16:08:20Z","snapshot_observed_at":"2026-08-16T07:29:02.618654Z","submitted_at":"2026-08-04T16:08:20Z","title":"Heterogeneity-Aware Microscaling for Efficient Low-Bit LLM Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:30.816676Z"},"links":{"cited_paper":"/paper/2412.19821","citing_paper":"/paper/2608.03867"},"observation_digest":"sha256:b819c2949cfdbef904712acc36875354521882ccc5b2e24d72ec3ecb255b0094","observation_id":"fe303a0a-7967-48ef-bba0-6916b10b4dd8","resolution":{"observed_at":"2026-08-05T10:54:31.243463Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.19821/citation-record","integrity":"/paper/2412.19821/integrity","json":"/paper/2412.19821/citation-record.json","paper":"/paper/2412.19821"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.018824Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.018824Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:280b527034785f3808d7800cb695f1bab012e85502cb224f0f9dd0fe9f21c5b8","observation_id":"3b3c2a16-66dc-49c1-8993-d70acc83da4c","resolution":{"observed_at":"2026-08-11T15:07:15.018824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.993044Z","title":"A., Awan, A","venue":null,"work_id":"5712d87c-35ed-4bbe-a8b7-aed8efb4442e","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.024205Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:e813ad60900a2ab8eb5efc52d87ef6f8cc9511e2801676c794daac3c53dd3db0","observation_id":"18110881-5841-4a97-9512-d0edc7b816b2","resolution":{"observed_at":"2026-08-11T15:07:15.996661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T15:07:15.028073Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.028073Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:a9c394c00269b3d0eb5fa636fdc69f45b49b813ae9c820170adaefa2556fcfe1","observation_id":"5e15c781-cb8e-4eb4-964f-e13e5fcc1945","resolution":{"observed_at":"2026-08-11T15:07:15.028073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.982041Z","title":"Pushing the Limits of Narrow Precision Inferencing at Cloud Scale with Microsoft Floating Point","venue":null,"work_id":"8e6b312a-b868-493f-ac28-f32efb882039","year":2020},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.034205Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:ac190799b080c9f139ee2622dba5a26d01023ddeeadfadb23d52359b93b63875","observation_id":"a3888b70-56c0-420a-b5fb-19dc4f01a8fe","resolution":{"observed_at":"2026-08-11T15:07:15.986125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.037771Z","title":"S., Naghshineh, S., Park, J., and Naumov, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.037771Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:e618580369e485b9a50a77cf9ec07d3dd581bd84a9c246041673764b73f2dee1","observation_id":"0d2701d2-b11e-4195-9589-79d87cd54c45","resolution":{"observed_at":"2026-08-11T15:07:15.037771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T15:07:15.041392Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.041392Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:ab23b5f04f3150599b0783dab89f2d5b3344785f6c237010ad576d70e36bd532","observation_id":"9ecb3caf-ef99-4dcf-a2d4-d0c303b6ae05","resolution":{"observed_at":"2026-08-11T15:07:15.041392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.971810Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","venue":null,"work_id":"0597e200-b28d-4edf-81e0-ca72ba335af0","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.045135Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:7be1d712456f19f1201dec63e70fb9bb4275032d963bd23d6d366e4e5a8d698f","observation_id":"5d24d47c-722b-44da-9ed9-1064805b8ead","resolution":{"observed_at":"2026-08-11T15:07:15.975476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.049136Z","title":"A framework for few-shot language model evaluation, 07 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.049136Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:6e42f48ab7948c575279dfc804e2c4a1f3b6ba35ee9e16d538160a3f4dcb8993","observation_id":"4fb3f5b5-37d6-48a1-a59d-ee1331fa31a8","resolution":{"observed_at":"2026-08-11T15:07:15.049136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.053141Z","title":"W., and Keutzer, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.053141Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:360fa668994bd657ee891f615a097c55123d87eff6b2741a3991c49eb4573caa","observation_id":"d3492629-1d75-429e-9f39-f19db6dfaa81","resolution":{"observed_at":"2026-08-11T15:07:15.053141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.961258Z","title":"A., Welbl, J., Clark, A., et al","venue":null,"work_id":"980ed8f4-b484-47fb-b4f6-4c8c00c233aa","year":2022},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.056792Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:018834f3527d44a823aaa61d5bd9b6e585b41f690e371baa61a209efdc334d89","observation_id":"44f585db-1f74-42ae-84bd-3d472420d805","resolution":{"observed_at":"2026-08-11T15:07:15.965139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.948991Z","title":"W., Shao, Y","venue":null,"work_id":"a0156b47-759c-4940-a0ff-7611bb4d22b8","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.060408Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:a30c4cf098141b4bb9fa347a8da332d5bc4f62d9d9be08115cb3d3223cb9f97d","observation_id":"8685261d-13d6-4220-97f3-1b40b9510a31","resolution":{"observed_at":"2026-08-11T15:07:15.952934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.937929Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":"808f31cb-8c12-4406-94c1-b2e78bca20f1","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.064390Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:7b82d246102b6b8a5f9642397667ac2788af086316189229526f5f5d97f20b68","observation_id":"e63849f1-c0bd-438e-9bfd-fc81cb5fd9dd","resolution":{"observed_at":"2026-08-11T15:07:15.941905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.927182Z","title":"B., Chess, B., Child, R., Gray, S., Radford, A., Wu, J., and Amodei, D","venue":null,"work_id":"32299761-ed45-4700-a907-bc4e04b73550","year":2020},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.068272Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:a2aa6bfe83b25c164f6c1a76439d529f53a88b856a69914dab5a6dd2acd29dc7","observation_id":"cc0f5156-fd88-4a40-b77f-45834615bd29","resolution":{"observed_at":"2026-08-11T15:07:15.931082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.916657Z","title":"J., Wang, X., Nassar, M., Bansal, A","venue":null,"work_id":"34f5f110-a0ef-4f05-a501-cda90daeb16d","year":2017},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.071681Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:fbf409621091f01c1fe896a1f261cc3aa98fd72d441a895a0098b8584b008a44","observation_id":"f10b2a27-b317-4a1b-b3c4-38f632a27e9b","resolution":{"observed_at":"2026-08-11T15:07:15.920175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.906613Z","title":"B., Zi, Y., Muennighoff, N., Kocetkov, D., Mou, C., Marone, M., Akiki, C., Li, J., Chim, J., Liu, Q., Zheltonozhskii, E., Zhuo, T","venue":null,"work_id":"8f25759e-69d5-4f46-91fa-c3057ab98c51","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.075307Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:6fcf122975ded69200310c8828b79bcdfa4094f3c97474d2bd7627ac2bf4c262","observation_id":"3f4e25aa-021c-4829-a9f1-0579f668bb34","resolution":{"observed_at":"2026-08-11T15:07:15.910113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.896078Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","venue":null,"work_id":"dd3677da-fb3f-477b-bd96-d7124c1c1238","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.078862Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:800d940a0b2b3930ccdac1cc4d6a4035b890ea64ece6a92a5cc12595b8a13540","observation_id":"60336d6a-f5f2-49a4-831f-23b32f20eda8","resolution":{"observed_at":"2026-08-11T15:07:15.899502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.083427Z","title":"and Liu, R.-S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.083427Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:39d7a8da6db78b58ca86392bb77517a65bfa2b6bd65ac55669c045e80fef3a24","observation_id":"04312f69-af70-4e42-8071-c64d58fa026c","resolution":{"observed_at":"2026-08-11T15:07:15.083427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.884994Z","title":"Block and subword-scaling floating-point ( BSFP ) : An efficient non-uniform quantization for low precision inference","venue":null,"work_id":"8717957f-eab2-40c2-b593-86a7446790d3","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.087187Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:b7827858edb9ba1d78b996a393cc53402d2689f8759ecee296a5c8129086f329","observation_id":"06f2469d-6d8d-455d-9035-6cf903d66ba0","resolution":{"observed_at":"2026-08-11T15:07:15.889084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.091124Z","title":"Lv: Latency-versatile floating-point engine for high-performance deep neural networks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.091124Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:25574bb4ff84c2336ded15d7964f8cd63535e7dbcd7dcd8f4f1877102f449e0f","observation_id":"fc762c23-1641-4367-a3a7-c482df4ed483","resolution":{"observed_at":"2026-08-11T15:07:15.091124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.095001Z","title":"P., Mallick, R., Wollaber, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.095001Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:451c3b6d388317b16a89c937c25bf19f9447133e9d6b90ed4112ef56dbca390c","observation_id":"f77f9c95-9e52-4f56-ae23-a0a84e321a76","resolution":{"observed_at":"2026-08-11T15:07:15.095001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.873497Z","title":"Intel Unleashes Enterprise AI with Gaudi 3, AI Open Systems Strategy and New Customer Wins","venue":null,"work_id":"0d117974-d58d-4e4e-8218-6ac767a2c03a","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.098780Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:71629e8a4650542ad53995dd9937679ed962b75cfc2e3b74d3d49693675d55b7","observation_id":"8f06c684-8754-4bcf-9dc1-d2ad0376fb90","resolution":{"observed_at":"2026-08-11T15:07:15.877503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.862104Z","title":"Pointer sentinel mixture models","venue":null,"work_id":"d773ae36-fe3a-4868-ada9-130a6912b607","year":2016},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.102652Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:ee170f3a24a66487aff9a529d3bb4a17605ecf62500cd2ed09470c789cad5367","observation_id":"04733370-e452-4e34-b4f8-c154b01b73a4","resolution":{"observed_at":"2026-08-11T15:07:15.866101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.848750Z","title":"Introducing Meta Llama 3: The most capable openly available LLM to date , 2024","venue":null,"work_id":"1b499b2b-55c7-408d-a6b8-a03626831c8d","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.106575Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:fc413e7b777ec2b76648de6f918e52b98270a9d13c88681c6fe2f3843c5cb893","observation_id":"1bc2d6b2-ceb3-4125-b0a0-1a38903ba942","resolution":{"observed_at":"2026-08-11T15:07:15.853935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.836944Z","title":"NVIDIA Blackwell Architecture Technical Brief","venue":null,"work_id":"460472c3-7b0c-48f2-94a2-70bf08af7161","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.110216Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:173b59c585af9132b7f84b33b6225e899c8efc48d4dd0c85c9b040ddf3b54882","observation_id":"7762bdee-58fa-4694-9342-c45f48f5c7e6","resolution":{"observed_at":"2026-08-11T15:07:15.841018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-11T15:07:15.114160Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ramé, A., Ferret, J., Liu, P., Tafti, P., Friesen, A., Casbon, M., Ramos, S., Kumar, R., Lan, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.114160Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:2c2a6421f0af708c036533acb9606f75e2d351413d97a187ac4194a4d81c0209","observation_id":"ed3168e4-ce56-4101-9dbc-99ee8b783333","resolution":{"observed_at":"2026-08-11T15:07:15.114160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.824625Z","title":"D., Garegrat, N., Savell, T., More, A., Han, K.-N., Zhao, R., Mathew Hall, J","venue":null,"work_id":"0ab85bdf-828e-4f78-b881-2e692095cd13","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.118478Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:5c32db76f903f92bc38d5c02a7c39b452148eafbc03bee7e934b8e8cde4d72e4","observation_id":"267e194d-5e2d-44c1-983e-4718e1e8edb5","resolution":{"observed_at":"2026-08-11T15:07:15.829095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.813216Z","title":null,"venue":null,"work_id":"ddfb26b4-f050-4229-8c41-3cf24625d4bf","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.122331Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:57e7db9b348da89a72b664600973018263b9c1888ec0422c2b1476f7c48e6277","observation_id":"b9296a21-9081-4672-a303-2d3d44187bd4","resolution":{"observed_at":"2026-08-11T15:07:15.817015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.126442Z","title":"Algorithm-Hardware Co-Design of Adaptive Floating-Point Encodings for Resilient Deep Learning Inference","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.126442Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:030073874a5a3a66bf046a6a43ee1eaca67fc5136f1826fb5572669bd19e1995","observation_id":"dbb0c251-fb08-465a-91bd-8e1a822fc2c4","resolution":{"observed_at":"2026-08-11T15:07:15.126442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.801603Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":null,"work_id":"6d08c28f-f06c-4966-be6c-3d10a05627c8","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.130334Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:2ecd3030e78583112b6f1c386d998c4b57298bae98e92619a9155afe5b1b3fb3","observation_id":"9305df71-5818-458b-9765-1992dfc1b5f3","resolution":{"observed_at":"2026-08-11T15:07:15.805672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.134083Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.134083Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:2a9634a7b3234d72c782fdb438bc700810ac47d5526f4fb9870fcb924c58286c","observation_id":"8d275a21-5971-4ade-9133-e96d894178c3","resolution":{"observed_at":"2026-08-11T15:07:15.134083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.781768Z","title":"How to Quadruple LLM Decoding Performance with Speculative Decoding (SpD) and Microscaling (MX) Formats on Qualcomm Cloud AI 100","venue":null,"work_id":"4b777d99-810a-4e09-b59b-b5674fcca156","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.138117Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:56c18aaf1337f78c3572fa3bdfbeb51714a2cba52a05e882cef77afaddeaa6f3","observation_id":"e4102f3b-1cb5-4f9c-9313-bd6091efc4e4","resolution":{"observed_at":"2026-08-11T15:07:15.785722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.769854Z","title":"GPTVQ: The Blessing of Dimensionality for LLM Quantization","venue":null,"work_id":"07f3221c-5b44-43f4-9c98-57a2307e33b7","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.142060Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:f4fb4ab0def3d08a6f7fe37538e5d33d4dd8793cc02399d0342bd500741fbbd4","observation_id":"5d11f7c8-5ac0-468f-9de7-7d5a79aee403","resolution":{"observed_at":"2026-08-11T15:07:15.773784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3624582","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.180927Z","title":"Sg-float: Achieving memory access and computing power reduction using self-gating float in cnns","venue":null,"work_id":"a5c7bab1-c285-4fee-a00c-4934b94408f5","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.145807Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:eafe4fe1c71e57d5d1a9d6a2048ddf19242f4bb2685343c767bb49541cf7cbf0","observation_id":"c6b1e348-98b5-4756-9f79-2a42c40efa11","resolution":{"observed_at":"2026-08-11T15:07:15.187085Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.759402Z","title":null,"venue":null,"work_id":"91c2f893-3092-4094-a3cc-3e0d548c86c1","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.149638Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:4fdfe0e7d4c274144204fa20eb0214d0063a22a0136f7973e46bf6f12fd399bf","observation_id":"199b1854-cbdc-4e42-af08-0edffc97e204","resolution":{"observed_at":"2026-08-11T15:07:15.762496Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.748773Z","title":"BiE: Bi-Exponent Block Floating-Point for Large Language Models Quantization","venue":null,"work_id":"53655b52-c9ee-4dec-a0e5-c68fab1b29c0","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.153580Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:47eae65aa50a9f96aeb9c812c54798e5cb830ec8ef6aead24a851ce65f2a336d","observation_id":"372c4e47-7429-4808-b478-5740c607a5a3","resolution":{"observed_at":"2026-08-11T15:07:15.752504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","latest_version":1,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":20},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2412.19821."}