{"as_of":"2026-08-19T00:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0ecd99c9944cd9302f9959c9a0db68a4eb02cf2cf08c7bfc6bb8e4e67495aad6","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:39:36.782352Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:42:59.643515Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T08:15:31.930344Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18653","snapshot_observed_at":"2026-08-10T20:42:59.643515Z","title":"1.58-bit flux","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.07730","last_updated":"2025-08-02T07:11:16Z","snapshot_observed_at":"2026-08-17T07:53:14.156204Z","submitted_at":"2025-01-13T22:37:17Z","title":"Democratizing Text-to-Image Masked Generative Models with Compact Text-Aware One-Dimensional Tokens","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:59.643515Z"},"links":{"cited_paper":"/paper/2412.18653","citing_paper":"/paper/2501.07730"},"observation_digest":"sha256:ecfe18ca48ed686b45b7920220a1ae2115442817301b650d8db4a7d018ccf37e","observation_id":"01a696b0-1b70-4bf4-b15e-294cdc495165","resolution":{"observed_at":"2026-08-10T20:42:59.643515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18653","snapshot_observed_at":"2026-08-07T15:33:12.353042Z","title":"1.58-bit flux","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.353042Z"},"links":{"cited_paper":"/paper/2412.18653","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:3826fc2e084ac1f13e5e4be770fa80a754761e0fc1720b83cecc393f4d772932","observation_id":"20031a9d-1774-46c2-9f24-63e9b5f8b4bd","resolution":{"observed_at":"2026-08-07T15:33:12.353042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18653","snapshot_observed_at":"2026-08-07T13:57:07.883088Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20569","last_updated":"2025-05-29T14:24:24Z","snapshot_observed_at":"2026-08-18T14:06:22.092841Z","submitted_at":"2025-05-26T23:06:54Z","title":"Retrieval Visual Contrastive Decoding to Mitigate Object Hallucinations in Large Vision-Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:07.883088Z"},"links":{"cited_paper":"/paper/2412.18653","citing_paper":"/paper/2505.20569"},"observation_digest":"sha256:6a174b0e4c0265b268afc010190a506fc8c8f24ecc10197afc5bbf606da155b6","observation_id":"19791cd6-72dd-400f-83eb-ced73d7df9ea","resolution":{"observed_at":"2026-08-07T13:57:07.883088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18653","snapshot_observed_at":"2026-08-06T22:42:45.239323Z","title":"1.58-bit flux","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20967","last_updated":"2025-06-27T08:42:17Z","snapshot_observed_at":"2026-08-13T23:16:20.107234Z","submitted_at":"2025-06-26T03:10:13Z","title":"DFVEdit: Conditional Delta Flow Vector for Zero-shot Video Editing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:45.239323Z"},"links":{"cited_paper":"/paper/2412.18653","citing_paper":"/paper/2506.20967"},"observation_digest":"sha256:c89700710b8cea73e5799c98b2f3a35d883b2fb06d9b5e05875c0991ca7deb28","observation_id":"e4902f6f-b6df-4ac1-9973-8e6d29559582","resolution":{"observed_at":"2026-08-06T22:42:45.239323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18653","snapshot_observed_at":"2026-08-06T13:19:35.659081Z","title":"1.58-bit flux,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20782","last_updated":"2025-07-28T12:52:23Z","snapshot_observed_at":"2026-08-13T11:20:47.667656Z","submitted_at":"2025-07-28T12:52:23Z","title":"Investigation of Accuracy and Bias in Face Recognition Trained with Synthetic Data","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T13:19:35.659081Z"},"links":{"cited_paper":"/paper/2412.18653","citing_paper":"/paper/2507.20782"},"observation_digest":"sha256:738e459e738bba862d1683f08f6a87f459d62ddbd64b1285903f80c4b22b597d","observation_id":"341967ce-a624-4e3d-bfd7-dce5f476e6b3","resolution":{"observed_at":"2026-08-06T13:19:35.659081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18653","snapshot_observed_at":"2026-08-05T19:15:33.544769Z","title":"1.58-bit flux,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13078","last_updated":"2025-08-18T16:48:57Z","snapshot_observed_at":"2026-08-15T12:53:52.998509Z","submitted_at":"2025-08-18T16:48:57Z","title":"ID-Card Synthetic Generation: Toward a Simulated Bona fide Dataset","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T19:15:33.544769Z"},"links":{"cited_paper":"/paper/2412.18653","citing_paper":"/paper/2508.13078"},"observation_digest":"sha256:5ebd5382caf7cd494a9b4d998bc7665d92c6301a3fbdfc4f2aeb1c921b78a68c","observation_id":"aaa632b9-92ab-4adf-b16b-e20b8a6d1fe8","resolution":{"observed_at":"2026-08-05T19:15:33.544769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"cited_work":{"arxiv_id":"2412.18653","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18653","snapshot_observed_at":"2026-07-01T08:15:31.930344Z","title":"1.58-bit FLUX","venue":null,"work_id":"ef79fd9b-49f9-450d-b52a-c228a816bf40","year":2024},"citing_paper":{"arxiv_id":"2604.04913","last_updated":"2026-04-06T17:55:05Z","snapshot_observed_at":"2026-08-17T02:35:09.266915Z","submitted_at":"2026-04-06T17:55:05Z","title":"A Frame is Worth One Token: Efficient Generative World Modeling with Delta Tokens","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-10T19:19:17.796377Z"},"links":{"cited_paper":"/paper/2412.18653","citing_paper":"/paper/2604.04913"},"observation_digest":"sha256:3d7ea0468af84db694080a0b8609158158c8b1527a78e21c841aae3f78739748","observation_id":"5a2b0492-a1cc-475d-aa5a-89f3791261df","resolution":{"observed_at":"2026-05-10T23:10:50.235148Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"cited_work":{"arxiv_id":"2412.18653","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18653","snapshot_observed_at":"2026-07-01T08:15:31.930344Z","title":"1.58-bit FLUX","venue":null,"work_id":"ef79fd9b-49f9-450d-b52a-c228a816bf40","year":2024},"citing_paper":{"arxiv_id":"2604.15521","last_updated":"2026-04-16T21:00:41Z","snapshot_observed_at":"2026-08-12T16:18:13.467015Z","submitted_at":"2026-04-16T21:00:41Z","title":"Frequency-Aware Flow Matching for High-Quality Image Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T10:58:05.541289Z"},"links":{"cited_paper":"/paper/2412.18653","citing_paper":"/paper/2604.15521"},"observation_digest":"sha256:25a5d307d7aa459690fc68e614a674fe1bf9342d5369a81cab3382d10d3bed93","observation_id":"059fb680-461a-4d25-a427-96f117d6d4fc","resolution":{"observed_at":"2026-05-10T11:00:04.073008Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"cited_work":{"arxiv_id":"2412.18653","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18653","snapshot_observed_at":"2026-07-01T08:15:31.930344Z","title":"1.58-bit FLUX","venue":null,"work_id":"ef79fd9b-49f9-450d-b52a-c228a816bf40","year":2024},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-16T10:31:22.339382Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2412.18653","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:b47550cd01f66b37acf702166a63e8ed1cc8ace102421fb814b3ceb934e3a491","observation_id":"5e5983b5-3dbc-4479-9b3e-56b8e2a0365e","resolution":{"observed_at":"2026-07-01T08:15:31.933006Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"cited_work":{"arxiv_id":"2412.18653","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18653","snapshot_observed_at":"2026-07-01T08:15:31.930344Z","title":"1.58-bit FLUX","venue":null,"work_id":"ef79fd9b-49f9-450d-b52a-c228a816bf40","year":2024},"citing_paper":{"arxiv_id":"2605.26632","last_updated":"2026-08-17T08:10:10Z","snapshot_observed_at":"2026-08-19T00:21:56.571073Z","submitted_at":"2026-05-26T07:09:49Z","title":"RT-Lynx: Putting GEMM Sparsity in the Right Place for Diffusion Models","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-29T19:40:42.033793Z"},"links":{"cited_paper":"/paper/2412.18653","citing_paper":"/paper/2605.26632"},"observation_digest":"sha256:0657a914584cb9d582831f0d57e979f1e972f1bacc6c417ebc7a9833d2118bcc","observation_id":"08b3fc18-4f03-41c5-94b8-04b8d30d8539","resolution":{"observed_at":"2026-06-29T19:43:54.719370Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.18653/citation-record","integrity":"/paper/2412.18653/integrity","json":"/paper/2412.18653/citation-record.json","paper":"/paper/2412.18653"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.976611Z","title":"https://news.adobe.com/news/news- details/2024/adobe-introduces-firefly-image-3-foundation- model-to-take-creative-exploration-and-ideation-to-new- heights","venue":null,"work_id":"6491475a-4b92-4792-8a6d-ae5e9b3d0091","year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.403669Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:17bbaac8020ba075e6ee903f1a27d5604f8510b96b610bf321496d352d98ed33","observation_id":"8592a99d-187b-4b12-969d-76cd8fd34043","resolution":{"observed_at":"2026-08-11T04:39:37.982191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.960894Z","title":"https://www.recraft.ai/blog/recraft-introduces- a-revolutionary-ai-model-that-thinks-in-design-language","venue":null,"work_id":"1205b0f4-5dca-4778-ad9b-6f2973a47edc","year":null},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.409204Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:402628c0ee50d06380bd2054d1b0c6ba05785ee3c51ba1d666e7207b06ec04df","observation_id":"f5010cf1-8ede-43b9-99aa-91f73c401e6f","resolution":{"observed_at":"2026-08-11T04:39:37.966510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:36.414506Z","title":"Improving image generation with better captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.414506Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:22ee33ae0be54ccac5d64a5f89350ac3bfac9e4901031363b7ab8f2f4f9642a1","observation_id":"647b98c0-f330-4163-a44d-f6ae38e97ade","resolution":{"observed_at":"2026-08-11T04:39:36.414506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.934634Z","title":"Zeroq: A novel zero shot quantization framework","venue":null,"work_id":"3f8c9472-ca5a-4bd2-9168-c029eb36846c","year":2020},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.427373Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:65353e6bfdbe94cf4f0b4c3d00c4d2236f3bc1bae84ab5d112bed6e8a4c99703","observation_id":"595c043f-a804-4c76-ac1e-bc4682571dc0","resolution":{"observed_at":"2026-08-11T04:39:37.940425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06995","last_updated":"2024-08-13T15:56:20Z","snapshot_observed_at":"2026-08-16T13:26:41.360501Z","submitted_at":"2024-08-13T15:56:20Z","title":"Low-Bitwidth Floating Point Quantization for Efficient High-Quality Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06995","snapshot_observed_at":"2026-08-11T04:39:36.434306Z","title":"Low-bitwidth floating point quantization for efficient high- quality diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.434306Z"},"links":{"cited_paper":"/paper/2408.06995","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:def85ca58b42625613291de885d01615773b7ded80bc2f74bbe3e6073c1483a8","observation_id":"07f37586-b5d1-43c7-8ca3-228c2fade14c","resolution":{"observed_at":"2026-08-11T04:39:36.434306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-11T04:39:36.441245Z","title":"Pixart- alpha: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.441245Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:5238ac2112dbb310a368b35d0b6c1555d9070e6c5eccb9b09511c7aba60b9bb5","observation_id":"33c414ae-e1b8-48f7-9506-2dddd3aa777f","resolution":{"observed_at":"2026-08-11T04:39:36.441245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17343","last_updated":"2024-11-19T09:58:07Z","snapshot_observed_at":"2026-08-16T13:39:52.238963Z","submitted_at":"2024-06-25T07:57:27Z","title":"Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17343","snapshot_observed_at":"2026-08-11T04:39:36.446559Z","title":"Q-dit: Ac- curate post-training quantization for diffusion transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.446559Z"},"links":{"cited_paper":"/paper/2406.17343","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:a667704b57166510c7b0f58e0edc58aa2b3a8fe00c3fda68a3b108cce2167d5f","observation_id":"40b8d72a-bb88-4478-81ee-a126a62648a7","resolution":{"observed_at":"2026-08-11T04:39:36.446559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05265","last_updated":"2025-01-27T13:39:25Z","snapshot_observed_at":"2026-08-16T13:11:48.628054Z","submitted_at":"2024-10-07T17:59:35Z","title":"PrefixQuant: Eliminating Outliers by Prefixed Tokens for Large Language Models Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05265","snapshot_observed_at":"2026-08-11T04:39:36.451619Z","title":"Prefixquant: Static quantization beats dy- namic through prefixed outliers in llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.451619Z"},"links":{"cited_paper":"/paper/2410.05265","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:9e5f1f93141c8ff12e7ba7ae0787ab39528ea239703f897a8ecd280116d9652b","observation_id":"ebf87b3c-a737-45a0-92df-431ea18ca8ca","resolution":{"observed_at":"2026-08-11T04:39:36.451619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11062","last_updated":"2025-05-19T06:20:01Z","snapshot_observed_at":"2026-08-16T13:35:20.246215Z","submitted_at":"2024-07-10T17:53:30Z","title":"EfficientQAT: Efficient Quantization-Aware Training for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11062","snapshot_observed_at":"2026-08-11T04:39:36.456617Z","title":"Efficientqat: Efficient quantization-aware training for large language models.arXiv preprint arXiv:2407.11062, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.456617Z"},"links":{"cited_paper":"/paper/2407.11062","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:c371b4681027b74e764c7e9b12cf07f23e8da8c3b42e4a3a96f2a1eb4e667895","observation_id":"187ab6a2-6840-48b0-9c1c-3bfbca806fa7","resolution":{"observed_at":"2026-08-11T04:39:36.456617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.917906Z","title":"Low-bit quantization of neural networks for efficient infer- ence","venue":null,"work_id":"090d5ca5-3816-48b0-8295-e42ea9b9e47f","year":2019},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.462301Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:8e3424f0a1497517fe281bf4cb49ba2edbde928b5083b822538e2d0d722717dd","observation_id":"2bece48e-ed86-484d-90c5-74836d0f8d60","resolution":{"observed_at":"2026-08-11T04:39:37.924037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.17131","last_updated":"2024-08-30T09:15:54Z","snapshot_observed_at":"2026-08-16T13:22:41.971390Z","submitted_at":"2024-08-30T09:15:54Z","title":"VQ4DiT: Efficient Post-Training Vector Quantization for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.17131","snapshot_observed_at":"2026-08-11T04:39:36.466927Z","title":"Vq4dit: Efficient post-training vec- tor quantization for diffusion transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.466927Z"},"links":{"cited_paper":"/paper/2408.17131","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:d0caca3fbe914071a5cd17cbddee12c91ed56a5437914f7882484125a221e6e7","observation_id":"cda3e752-a9c6-4a44-a951-e049186429a4","resolution":{"observed_at":"2026-08-11T04:39:36.466927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:36.472201Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.472201Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:ff4d7a238f603a0bcb5e6ca60942b5d8e16bbff76684e581628087bddcb31772","observation_id":"46c534e0-3e77-4274-8e57-8bbb3025aa23","resolution":{"observed_at":"2026-08-11T04:39:36.472201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.891103Z","title":"Hawq: Hessian aware quantization of neural networks with mixed-precision","venue":null,"work_id":"5dd9013b-7f61-4240-acf2-96d6274d9357","year":2019},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.476903Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:849dd2875a538e43e0b56b72fa4b8199c20dc73c2d4b67845fcff130748c5633","observation_id":"1652314b-7db8-41ad-b705-002595b4989c","resolution":{"observed_at":"2026-08-11T04:39:37.896257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:36.486213Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.486213Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:20ec1f78255d8c45dbae1f78252d255516e37a270ab9abba9e822f6457256689","observation_id":"89f211d9-5c2c-4527-9772-15e90d0fed29","resolution":{"observed_at":"2026-08-11T04:39:36.486213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.08153","last_updated":"2020-05-07T03:30:49Z","snapshot_observed_at":"2026-08-18T09:17:55.370547Z","submitted_at":"2019-02-21T17:31:32Z","title":"Learned Step Size Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.08153","snapshot_observed_at":"2026-08-11T04:39:36.491037Z","title":"Learned step size quantization","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.491037Z"},"links":{"cited_paper":"/paper/1902.08153","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:63ec2238323d18fba5ce6a5e5a16ece41bd16330c2ee0c113b85b25ee664466a","observation_id":"610122ef-155f-4923-9af8-8ad862fd1f8c","resolution":{"observed_at":"2026-08-11T04:39:36.491037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-16T07:57:19.216626Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-11T04:39:36.496093Z","title":"Gptq: Accurate post-training quantization for generative pre-trained transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.496093Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:035625d6729b5be4436b5df4f1571d80b3da18485039f6816ba9e2059ccfd1a6","observation_id":"871e3147-c6e6-4780-92f0-91a9a0f8867c","resolution":{"observed_at":"2026-08-11T04:39:36.496093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.865486Z","title":"Geneval: An object-focused framework for evaluating text- to-image alignment","venue":null,"work_id":"b5cb210a-b468-4a0e-8729-83ca2c30b13e","year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.501182Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:b7b9e99a594ca442b15dcadb1073c8d5dd4cd1f0a30b325ab48b41ed94551ea1","observation_id":"51ea60b3-5ee2-4096-ba63-acde92bb95d2","resolution":{"observed_at":"2026-08-11T04:39:37.870305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.849385Z","title":"Differ- entiable soft quantization: Bridging full-precision and low- bit neural networks","venue":null,"work_id":"41c62155-e225-4599-a602-3d09a6f210a3","year":null},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.506017Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:fd5b4d96d0a4b8997ec28e1b3be4894e26a07e11c5f6be6facabb83fd6c19484","observation_id":"846e1dfc-7814-4474-aa83-7aeaf50af73e","resolution":{"observed_at":"2026-08-11T04:39:37.854530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.00149","last_updated":"2016-02-15T06:25:40Z","snapshot_observed_at":"2026-08-04T16:59:47.843960Z","submitted_at":"2015-10-01T09:03:44Z","title":"Deep Compression: Compressing Deep Neural Networks with Pruning, Trained Quantization and Huffman Coding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.00149","snapshot_observed_at":"2026-08-11T04:39:36.510956Z","title":"Deep com- pression: Compressing deep neural networks with pruning, trained quantization and huffman coding","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.510956Z"},"links":{"cited_paper":"/paper/1510.00149","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:db0885a463c1a790770fd6668d5d8856eb9caeb062b2852a1988954fea9d933d","observation_id":"3fc80dba-69cf-47ec-905e-99de56623804","resolution":{"observed_at":"2026-08-11T04:39:36.510956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03270","last_updated":"2024-04-13T07:33:57Z","snapshot_observed_at":"2026-08-18T09:15:03.547791Z","submitted_at":"2023-10-05T02:51:53Z","title":"EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03270","snapshot_observed_at":"2026-08-11T04:39:36.520801Z","title":"Efficientdm: Efficient quantization-aware fine-tuning of low-bit diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.520801Z"},"links":{"cited_paper":"/paper/2310.03270","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:3964f4230801cdd2b63418a067c0d2d15a10512cd84d5aaa40da03da27ff1d11","observation_id":"1dc638d4-cb4a-4a82-8133-c64320a3bd2e","resolution":{"observed_at":"2026-08-11T04:39:36.520801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.833345Z","title":"Bivit: Extremely com- pressed binary vision transformers","venue":null,"work_id":"cafc78c8-3302-4977-97b6-9c04f472b9b6","year":2023},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.537266Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:bd4f01d0084326de820c2af2a049d286ce67871e3e7a0ae7f5eb9bd7138660b8","observation_id":"96ad31bc-790b-4685-9b7b-45bf5f44d917","resolution":{"observed_at":"2026-08-11T04:39:37.838907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.816874Z","title":"Ptqd: Accurate post-training quantization for diffusion models","venue":null,"work_id":"13263ad7-4dc1-439f-be9a-6cca13d4d83d","year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.542474Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:c43ee926325026d8640236ea691c75b2dec68e762603effd5ecc300e939c45ce","observation_id":"5ae1771d-6c94-46ad-a192-cd74bc67e6cf","resolution":{"observed_at":"2026-08-11T04:39:37.822262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.799068Z","title":"T2i-compbench: A comprehensive bench- mark for open-world compositional text-to-image genera- tion","venue":null,"work_id":"a3e01348-f553-451a-b377-29197bc102fe","year":2023},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.555031Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:7473b863a8aa8a6798e7077b3a646638e06ae010a9d19cf192ed830a76062e9f","observation_id":"d62d83da-c5c4-4a0d-9fcf-368fee71b7a5","resolution":{"observed_at":"2026-08-11T04:39:37.804801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.782669Z","title":"Tfmq-dm: Temporal feature maintenance quantization for diffusion models","venue":null,"work_id":"9a3c24f3-28fb-43e8-a3a8-b6dbd6698d89","year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.559878Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:e29e61361cc93fbd2796c426bac5446d93c29f19ad8166d3d5bf5e33a4b737ef","observation_id":"55dfd226-8692-4bf8-80f5-0bf4274620eb","resolution":{"observed_at":"2026-08-11T04:39:37.787764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.767410Z","title":"Binarized neural networks","venue":null,"work_id":"072d3805-9d95-4986-a421-03dd7385545b","year":2016},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.564736Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:e8435796ad843d014554faca4b26a63640ac71c851fc087d53d156c9506f3347","observation_id":"7148d9d9-2ce0-455f-b472-6e9b3db66c3a","resolution":{"observed_at":"2026-08-11T04:39:37.772843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.750805Z","title":"https://updates.midjourney.com/version-6-1/","venue":null,"work_id":"a2799348-22c2-45d4-8e2a-427a60eaf76a","year":null},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.569384Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:7dc94cdca3573d9a350a573301e504e5bbbb4de33769e96a0adc51f7085547d3","observation_id":"f1de931d-f494-4fda-a68b-6367846e4baf","resolution":{"observed_at":"2026-08-11T04:39:37.756025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.735239Z","title":"Quantization and training of neural networks for efficient integer-arithmetic-only inference","venue":null,"work_id":"8bd239b8-afa9-4c72-9d38-fdaff09fde28","year":2018},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.574166Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:dd3069f9a5e975c187d0aeecf1ee25ca63f89be7a464ea2b79b0fa4c9e21cd28","observation_id":"1302cbce-b2b2-411d-95e1-9b8dd77192b6","resolution":{"observed_at":"2026-08-11T04:39:37.740684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-16T15:24:21.726803Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-08-11T04:39:36.579296Z","title":"Squeezellm: Dense-and-sparse quantization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.579296Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:79e3f94f0c21e173ab49a965cdf81261e1ab4af51f7f212d326dec342df1c1ad","observation_id":"2006d8ae-b07d-40b6-9803-43fa6828a3b0","resolution":{"observed_at":"2026-08-11T04:39:36.579296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:36.584149Z","title":"https://blackforestlabs.ai/announcements/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.584149Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:88cb8c400132a9ba9c7fe70de8cd711416870b3a7026fe62a4d2a03cbb34547a","observation_id":"5832f977-ce81-4a2f-acc9-7bf8e1128501","resolution":{"observed_at":"2026-08-11T04:39:36.584149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.708886Z","title":"https://github.com/black-forest-labs/flux","venue":null,"work_id":"d72f994e-0e1b-4d45-b56f-3c212bb9e73c","year":null},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.595611Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:6e89fe02d88ffe044f948e965423605aff41cac84b0c45431a3832ad1f59dddd","observation_id":"f54723fa-c0ae-4e7d-bf01-56cfc925e9e8","resolution":{"observed_at":"2026-08-11T04:39:37.714016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17245","last_updated":"2024-02-27T06:31:52Z","snapshot_observed_at":"2026-08-16T13:11:20.195602Z","submitted_at":"2024-02-27T06:31:52Z","title":"Playground v2.5: Three Insights towards Enhancing Aesthetic Quality in Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17245","snapshot_observed_at":"2026-08-11T04:39:36.600834Z","title":"Playground v2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.600834Z"},"links":{"cited_paper":"/paper/2402.17245","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:cede58285f7390f76f05cc0d8e43ab7b244afcbc4add595b37b677efac3dd4fa","observation_id":"e7289807-6eed-49a3-96fc-d5362b354410","resolution":{"observed_at":"2026-08-11T04:39:36.600834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:36.605408Z","title":"Svdquant: Absorbing outliers by low- rank components for 4-bit diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.605408Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:08cb9d9ea2346ddcb870a17e6f3c913c19bf3bfe881ccc430ed0108b37ac309a","observation_id":"50dd2571-8d99-45a6-b092-12b29787dd6b","resolution":{"observed_at":"2026-08-11T04:39:36.605408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.693515Z","title":"Q-diffusion: Quantizing diffusion models","venue":null,"work_id":"6af417a0-f6ef-406b-8de6-f385ffcd841e","year":2023},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.610728Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:0e63f2453e328b05e17417fd669584f0e639e1fe53d958aec41bf522248c13bd","observation_id":"3d3b41c4-7064-4bc3-9e48-4c115be7d568","resolution":{"observed_at":"2026-08-11T04:39:37.698705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:36.619684Z","title":"Awq: Activation-aware weight quantization for on-device llm compression and acceleration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.619684Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:d2c1b0581130165ffa61b7f37b0de46457ed2a42592010281ba2c59806a55768","observation_id":"7194ad15-f58f-4c1a-bb59-60b06c5ca154","resolution":{"observed_at":"2026-08-11T04:39:36.619684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04532","last_updated":"2025-05-01T02:14:05Z","snapshot_observed_at":"2026-08-16T13:54:34.341970Z","submitted_at":"2024-05-07T17:59:30Z","title":"QServe: W4A8KV4 Quantization and System Co-design for Efficient LLM Serving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04532","snapshot_observed_at":"2026-08-11T04:39:36.624583Z","title":"Qserve: W4a8kv4 quantization and system co-design for efficient llm serving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.624583Z"},"links":{"cited_paper":"/paper/2405.04532","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:afb8250c8d9b054b904d2c263ab9b8dbcc7ab7ac158e645c8921eb01ce75cc1f","observation_id":"517bd047-c647-42d4-890f-c0d819396f49","resolution":{"observed_at":"2026-08-11T04:39:36.624583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10695","last_updated":"2024-10-21T20:01:13Z","snapshot_observed_at":"2026-08-16T13:18:02.646429Z","submitted_at":"2024-09-16T19:52:24Z","title":"Playground v3: Improving Text-to-Image Alignment with Deep-Fusion Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10695","snapshot_observed_at":"2026-08-11T04:39:36.630126Z","title":"Playground v3: Im- proving text-to-image alignment with deep-fusion large lan- guage models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.630126Z"},"links":{"cited_paper":"/paper/2409.10695","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:b087aaf1dd1784cf9a0f8172ee730d975e7f345db850dfd1ed130d753e5e5885","observation_id":"2b7d4d9a-5f22-48e9-8f3c-87bf35b52059","resolution":{"observed_at":"2026-08-11T04:39:36.630126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19751","last_updated":"2024-05-31T15:48:05Z","snapshot_observed_at":"2026-08-18T12:04:06.456233Z","submitted_at":"2024-05-30T06:56:11Z","title":"HQ-DiT: Efficient Diffusion Transformer with FP4 Hybrid Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19751","snapshot_observed_at":"2026-08-11T04:39:36.635471Z","title":"Hq-dit: Efficient diffu- sion transformer with fp4 hybrid quantization.arXiv preprint arXiv:2405.19751, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.635471Z"},"links":{"cited_paper":"/paper/2405.19751","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:da962f591711e25b11e47e1e7ceb5bd6450b8b6831e6827c840f5f9573ac6552","observation_id":"43cd28b1-221b-4339-abe2-9d58b81b955e","resolution":{"observed_at":"2026-08-11T04:39:36.635471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04585","last_updated":"2025-06-22T12:05:22Z","snapshot_observed_at":"2026-08-16T14:28:48.263644Z","submitted_at":"2024-01-09T14:42:49Z","title":"EDA-DM: Enhanced Distribution Alignment for Post-Training Quantization of Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04585","snapshot_observed_at":"2026-08-11T04:39:36.641038Z","title":"En- hanced distribution alignment for post-training quantization of diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.641038Z"},"links":{"cited_paper":"/paper/2401.04585","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:3843d41cd0e7ad3701e5297da0afecc7ecae354465b28747ae91a19cf0e90263","observation_id":"481896e5-0976-4c7a-902e-6b5fe821096c","resolution":{"observed_at":"2026-08-11T04:39:36.641038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-16T15:28:47.324188Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-11T04:39:36.646370Z","title":"Llm-qat: Data-free quantization aware training for large language models.arXiv preprint arXiv:2305.17888, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.646370Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:f0f3d2161c485127b12c9f66354e50aec340e6b25b483b0913af311915814d6b","observation_id":"2f9733cd-a913-48a1-8749-859d50e49216","resolution":{"observed_at":"2026-08-11T04:39:36.646370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-14T15:17:37.878305Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-11T04:39:36.651851Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.651851Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:0ea2f629d622ad16b142fac29755495bf5b51c73bacf43c1298e335be24d19dc","observation_id":"1c3c529f-d120-49a8-82bc-a475ec652e09","resolution":{"observed_at":"2026-08-11T04:39:36.651851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.667381Z","title":"https://updates.midjourney.com/version-6-1/","venue":null,"work_id":"5ea05cec-ae7b-4a2d-84c2-e9bd0f9653e8","year":null},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.657295Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:6097f48e2f9273ee602b8d49ef5856366ec884df5216301d00513912851d51be","observation_id":"1a7055dd-5e56-40ed-9381-3b348b3f7159","resolution":{"observed_at":"2026-08-11T04:39:37.672372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:36.662470Z","title":"Up or down? adap- tive rounding for post-training quantization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.662470Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:7546edc187f735a2bfaf38ed47a96a944663fa41947dcd3ca2da6bf70c800df8","observation_id":"719a1dad-edf4-4251-bc40-80662d15b55c","resolution":{"observed_at":"2026-08-11T04:39:36.662470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08295","last_updated":"2021-06-15T17:12:42Z","snapshot_observed_at":"2026-08-02T11:19:40.664702Z","submitted_at":"2021-06-15T17:12:42Z","title":"A White Paper on Neural Network Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08295","snapshot_observed_at":"2026-08-11T04:39:36.668815Z","title":"A white paper on neural network quantization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.668815Z"},"links":{"cited_paper":"/paper/2106.08295","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:41a355c556f95a4af825e418fc6ae1e68745ad2b08a64d905d5c19a49fad94c7","observation_id":"5b610852-d0e2-4d8d-a3e5-e68da08b25e3","resolution":{"observed_at":"2026-08-11T04:39:36.668815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.639935Z","title":"Overcoming oscillations in quantization-aware training","venue":null,"work_id":"ac288be8-027e-4a24-93ce-6202e392f853","year":2022},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.674696Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:55709e60432b83a2c83d4bf201308fd956d66187c9ea75e301cc87b15f898fc0","observation_id":"f7e71c00-2390-4dc1-a130-1365c749113e","resolution":{"observed_at":"2026-08-11T04:39:37.645721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-11T04:39:36.679674Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.679674Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:563e4c42bb6d3b6dea4e9b066880be3a99c333aaa44cf35763f3223b4025334a","observation_id":"4dc51f50-ceb8-4f02-8b5b-923fb1960d27","resolution":{"observed_at":"2026-08-11T04:39:36.679674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.618328Z","title":"Post-training quantization on diffusion models","venue":null,"work_id":"98ed2c22-8f46-4da5-b9ac-adf4d2048f3b","year":1972},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.684842Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:fa8ad18ea4b096914a5d42fe886d0af82e7e436ef8d7988853d230349158782c","observation_id":"e0156acb-c6ae-4961-beb1-a9833493b2db","resolution":{"observed_at":"2026-08-11T04:39:37.625549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13137","last_updated":"2024-03-18T05:33:22Z","snapshot_observed_at":"2026-08-16T15:05:54.961547Z","submitted_at":"2023-08-25T02:28:35Z","title":"OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13137","snapshot_observed_at":"2026-08-11T04:39:36.690379Z","title":"Omniquant: Omnidirectionally calibrated quantization for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.690379Z"},"links":{"cited_paper":"/paper/2308.13137","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:a7ff02c539d3488843a612c0c8420c73eef7a065ae0e742821f15b2e44ebc4ce","observation_id":"d62f4fac-01c8-4248-860e-8ba3c44f1feb","resolution":{"observed_at":"2026-08-11T04:39:36.690379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04333","last_updated":"2024-10-26T06:16:55Z","snapshot_observed_at":"2026-08-17T07:37:19.875108Z","submitted_at":"2024-06-06T17:59:23Z","title":"BitsFusion: 1.99 bits Weight Quantization of Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04333","snapshot_observed_at":"2026-08-11T04:39:36.695601Z","title":"Bitsfusion: 1.99 bits weight quantization of diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.695601Z"},"links":{"cited_paper":"/paper/2406.04333","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:4b3ad07bdcf95948bab2d4fe40b6159e0d47e9318520373fb05f9c924379fbd0","observation_id":"8e7a8cb3-1789-409c-8828-a815010e5aef","resolution":{"observed_at":"2026-08-11T04:39:36.695601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.600553Z","title":"Post-training quan- tization with progressive calibration and activation relaxing for text-to-image diffusion models","venue":null,"work_id":"0a0c104a-8c7f-4b4f-8584-bbb9e99af4bb","year":2025},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.700816Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:1ddfbcf6416ed77d828e6f448c3384a2812245db7fa5ef861fabc80fcd4b1d5e","observation_id":"6f3313b9-5a6c-45be-b52f-495bcdbef99e","resolution":{"observed_at":"2026-08-11T04:39:37.607085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.584107Z","title":"Towards accurate post-training quantization for diffusion models","venue":null,"work_id":"b81e8045-922f-402f-9115-e163abfed4d4","year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.705822Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:7797a68b5097e5abbf1e4dff448ae5d146707d3e5378afea322fc4ce5d7b7ad4","observation_id":"d2a9a58c-ab3c-45d4-b46d-07a5dd6c100b","resolution":{"observed_at":"2026-08-11T04:39:37.589407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11453","last_updated":"2023-10-17T17:59:15Z","snapshot_observed_at":"2026-08-15T04:43:14.762539Z","submitted_at":"2023-10-17T17:59:15Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11453","snapshot_observed_at":"2026-08-11T04:39:36.710683Z","title":"Bitnet: Scaling 1-bit trans- formers for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.710683Z"},"links":{"cited_paper":"/paper/2310.11453","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:194adb3e46024b7b8232ee67804a8894df158c8b1ce52aaa8e6b3de648168024","observation_id":"af450a87-0dfe-4d07-b105-fa4e0b0ea00e","resolution":{"observed_at":"2026-08-11T04:39:36.710683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16144","last_updated":"2024-10-23T11:17:42Z","snapshot_observed_at":"2026-08-16T13:07:20.085363Z","submitted_at":"2024-10-21T16:14:57Z","title":"1-bit AI Infra: Part 1.1, Fast and Lossless BitNet b1.58 Inference on CPUs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16144","snapshot_observed_at":"2026-08-11T04:39:36.716036Z","title":"1-bit ai infra: Part 1.1, fast and lossless bitnet b1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.716036Z"},"links":{"cited_paper":"/paper/2410.16144","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:896674b8d6b81fb866e5d20023f083663df1167aa9b89401071082b92f98e451","observation_id":"d1c6e3e3-1bf0-4176-ab3d-c2012598070f","resolution":{"observed_at":"2026-08-11T04:39:36.716036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.556876Z","title":"Haq: Hardware-aware automated quantization with mixed precision","venue":null,"work_id":"af15bb7b-1ad2-46ea-8e6e-243aafeac8d7","year":2019},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.720986Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:518aa42297ac1abedb2ab833e5cda6ab46474518057e4e092de15a7dcc093ec3","observation_id":"693dbcb1-67e1-4669-ae52-be1f5c985e68","resolution":{"observed_at":"2026-08-11T04:39:37.565698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.536056Z","title":"Outlier suppression: Pushing the limit of low-bit transformer language models","venue":null,"work_id":"400c4aef-3a74-444b-8c4c-7be86a0a2e89","year":2022},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.725981Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:c90889b0ccad79747b07ba69ac0728219a1a4a550381f340b21bd6b611a58b9f","observation_id":"d99da525-ee90-48cf-aa2e-4b479e4ae495","resolution":{"observed_at":"2026-08-11T04:39:37.542223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16005","last_updated":"2024-10-17T15:28:15Z","snapshot_observed_at":"2026-08-16T13:49:34.549029Z","submitted_at":"2024-05-25T02:02:08Z","title":"PTQ4DiT: Post-training Quantization for Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16005","snapshot_observed_at":"2026-08-11T04:39:36.730855Z","title":"Ptq4dit: Post-training quantization for diffu- sion transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.730855Z"},"links":{"cited_paper":"/paper/2405.16005","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:676868d1288cc319f60243db141163a2dc58b3c83b8be7f4bfbf1363f2e4da57","observation_id":"a779e1dc-0b10-4b7c-8f51-d58bed7047e6","resolution":{"observed_at":"2026-08-11T04:39:36.730855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:36.737437Z","title":"Smoothquant: Accurate and effi- cient post-training quantization for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.737437Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:bc0e763d65aaf816f131ccbcc3a8236881b3a4205fadbf18f894fb23ad3c1881","observation_id":"2ad609c4-0c55-4b2c-b6aa-f3d6219e7f4d","resolution":{"observed_at":"2026-08-11T04:39:36.737437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05431","last_updated":"2023-12-09T01:47:16Z","snapshot_observed_at":"2026-08-17T22:13:48.595839Z","submitted_at":"2023-12-09T01:47:16Z","title":"Efficient Quantization Strategies for Latent Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05431","snapshot_observed_at":"2026-08-11T04:39:36.742987Z","title":"Efficient quantization strategies for latent diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.742987Z"},"links":{"cited_paper":"/paper/2312.05431","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:5439a2c004c3e8966f91119cc17989a9fbdcf7be3b7f52e38daf849e65d76735","observation_id":"32b15292-ec6c-4508-8311-6ed4e6f7b8b2","resolution":{"observed_at":"2026-08-11T04:39:36.742987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03917","last_updated":"2024-07-04T13:22:31Z","snapshot_observed_at":"2026-08-17T16:57:26.086710Z","submitted_at":"2024-07-04T13:22:31Z","title":"Timestep-Aware Correction for Quantized Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03917","snapshot_observed_at":"2026-08-11T04:39:36.748329Z","title":"Timestep-aware cor- rection for quantized diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.748329Z"},"links":{"cited_paper":"/paper/2407.03917","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:8d69ef897a3aad1696a611a2daac51996b3542fcbfc0b3fb825590d1c7a77997","observation_id":"a62a6782-c4ca-45d6-8a42-6a9a0c3603cc","resolution":{"observed_at":"2026-08-11T04:39:36.748329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.505256Z","title":"Zeroquant: Ef- ficient and affordable post-training quantization for large- scale transformers","venue":null,"work_id":"b693c12b-4cc7-4240-b860-d4d9625679ce","year":2022},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.754847Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:b0e536205a6c6d4ecfe911bbeaa25f76cf50a469c1f1bba5b12576c4f6465ea6","observation_id":"9d2fbb5d-c982-4d4f-bf5d-a1c276cecbf2","resolution":{"observed_at":"2026-08-11T04:39:37.511222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10789","last_updated":"2022-06-22T01:11:29Z","snapshot_observed_at":"2026-08-18T22:18:02.034966Z","submitted_at":"2022-06-22T01:11:29Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10789","snapshot_observed_at":"2026-08-11T04:39:36.759706Z","title":"Scaling autoregres- sive models for content-rich text-to-image generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.759706Z"},"links":{"cited_paper":"/paper/2206.10789","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:44b53561fa73d484dc8fffba8f81aabbe063704cb8892e39c0abd4c1df622e9a","observation_id":"06afcad5-ae64-4a94-af83-a593239ac90c","resolution":{"observed_at":"2026-08-11T04:39:36.759706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02540","last_updated":"2025-02-22T16:29:03Z","snapshot_observed_at":"2026-08-18T09:54:14.497921Z","submitted_at":"2024-06-04T17:57:10Z","title":"ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02540","snapshot_observed_at":"2026-08-11T04:39:36.765459Z","title":"Vidit-q: Efficient and accurate quantization of diffusion transformers for im- age and video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.765459Z"},"links":{"cited_paper":"/paper/2406.02540","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:64c1cbba165e1f58d5e21c642800ae4733e85d202e4563f93e42422169a5782f","observation_id":"b51d65e1-d231-4621-8537-a5ce48b93d92","resolution":{"observed_at":"2026-08-11T04:39:36.765459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17873","last_updated":"2024-05-30T01:51:10Z","snapshot_observed_at":"2026-08-16T13:48:46.119775Z","submitted_at":"2024-05-28T06:50:58Z","title":"MixDQ: Memory-Efficient Few-Step Text-to-Image Diffusion Models with Metric-Decoupled Mixed Precision Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17873","snapshot_observed_at":"2026-08-11T04:39:36.771152Z","title":"Mixdq: Memory-efficient few-step text-to-image dif- fusion models with metric-decoupled mixed precision quan- tization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.771152Z"},"links":{"cited_paper":"/paper/2405.17873","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:f7114a761163db57c3ec9ffb125d30c47ab2fb227586dc706aab0eaec519ccca","observation_id":"be355e0f-dbd9-43ba-b537-1d5b90172431","resolution":{"observed_at":"2026-08-11T04:39:36.771152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:39:37.485817Z","title":"Atom: Low-bit quantization for efficient and accurate llm serving","venue":null,"work_id":"e2c1a274-1ae8-4071-ab70-145fb4a30c64","year":2024},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.782352Z"},"links":{"citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:13edf8cf047465e0c80cf9dc1755df3b8b3a017e0baa378ce7a26e1a60fc9058","observation_id":"dbef7a13-aeef-4d99-9759-28e97d07ed56","resolution":{"observed_at":"2026-08-11T04:39:37.493174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 10 inbound Pith citation observations for arXiv:2412.18653."}