{"as_of":"2026-08-16T05:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:852ee539f59b9c85dda428326b0fd5751fd33020d0007605d2b0f90da1284814","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T18:18:05.706979Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:46:23.173339Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T21:46:23.280942Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"cited_work":{"arxiv_id":"2411.11745","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.11745","snapshot_observed_at":"2026-08-15T21:46:23.280942Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","venue":"cs.LG","work_id":"88265e88-f3d4-4b5a-8279-03819c67950c","year":2024},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.173339Z"},"links":{"cited_paper":"/paper/2411.11745","citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:97925fc8fd1bce81f29cedff5c3ce72f7f7d1c9ebe8d78cb93c287ce908ade91","observation_id":"f4ac93e7-a401-4204-8c39-840f13031454","resolution":{"observed_at":"2026-08-15T21:46:23.285813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.11745/citation-record","integrity":"/paper/2411.11745/integrity","json":"/paper/2411.11745/citation-record.json","paper":"/paper/2411.11745"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:07.088886Z","title":"01-ai/yi-6b","venue":null,"work_id":"78af4f96-50a2-4efd-aca2-e294f87027f5","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.257355Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:1cebba06581401a7ffde48b43d01d70a0743fc1f9587a588a4d4d61fdf5d1a5a","observation_id":"5980f8c2-9ac9-4b74-8e65-5e0c6bca93cd","resolution":{"observed_at":"2026-08-12T18:18:07.093803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.14252531","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:05.741868Z","title":"BitMoD Artifacts,","venue":null,"work_id":"b0c67846-087a-4b67-8cd3-083496fa246c","year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.265724Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:998ac178f5a9de87d06a59d76ddfce8527c395c7aad2740fc461a57794f4061e","observation_id":"f3db5b81-78fd-46ec-817c-fb981a9bd287","resolution":{"observed_at":"2026-08-12T18:18:05.748429Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:07.073563Z","title":"Bit-pragmatic deep neural network computing,","venue":null,"work_id":"49473a0c-7dec-4968-a8d2-cd858d18d591","year":2017},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.271979Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:6a157475806c85a5a9bc8eac83b4c0fe6741dbad46ccb0606353a01b677d592b","observation_id":"85c2b403-7f55-4119-9554-9a3dc3c2039f","resolution":{"observed_at":"2026-08-12T18:18:07.078440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-13T00:40:50.161960Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-12T18:18:05.277708Z","title":"QuaRot: Outlier-free 4-bit inference in rotated llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.277708Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:29ce8271285f30dd61905062dce2ddba0d21a7de4ea9b16236f06d0a38ba5740","observation_id":"b1d1d050-6357-4e44-a76b-6576bf2429e7","resolution":{"observed_at":"2026-08-12T18:18:05.277708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:07.058845Z","title":"FPRaker: A process- ing element for accelerating neural network training,","venue":null,"work_id":"9a1002ef-6177-4adf-8778-2d9220023790","year":2020},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.284471Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:51548144ffbf582cd73ae3669e45f1e202a9361ca30c043cf670a756179b9467","observation_id":"283835d1-d567-4638-a37d-c325ce5fac9f","resolution":{"observed_at":"2026-08-12T18:18:07.063442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:07.042607Z","title":"CACTI 7: New tools for interconnect exploration in innovative off-chip memories,","venue":null,"work_id":"93cbfc2f-6349-4b1f-9e11-79db6e8a1b45","year":2017},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.290001Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:974ed187a24fc8943df88a15e05ae95193e01328c5a92d63a8bed9c8c26f7996","observation_id":"1ab82118-8b93-4fd4-b0b9-4639df009127","resolution":{"observed_at":"2026-08-12T18:18:07.048207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11641","last_updated":"2019-11-26T15:31:46Z","snapshot_observed_at":"2026-08-08T00:48:01.603669Z","submitted_at":"2019-11-26T15:31:46Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11641","snapshot_observed_at":"2026-08-12T18:18:05.295419Z","title":"PIQA: Reason- ing about physical commonsense in natural language,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.295419Z"},"links":{"cited_paper":"/paper/1911.11641","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:2853a21db2e1de883d9d231741b4d32fb17424ede004bbbcde01b2b4be49f377","observation_id":"8247cbb4-f2c7-479e-af6c-7e86b6ba2857","resolution":{"observed_at":"2026-08-12T18:18:05.295419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:07.027339Z","title":"A signed binary multiplication technique,","venue":null,"work_id":"a4d83adc-0d05-46a9-8626-986e8a03c2ce","year":1951},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.301841Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:5be57ae0267fef554c4824728cfcdea943ed52bcea673914e747ed49a88975fd","observation_id":"1bb55cd6-20b9-410b-85a1-fc2509bf2904","resolution":{"observed_at":"2026-08-12T18:18:07.032222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:07.011522Z","title":"Language Models are Few-Shot Learners,","venue":null,"work_id":"3fe53851-7a3b-423f-b51b-3fc2ce63f6cb","year":2020},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.306784Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:36a9f9f1695ce41920f23a65d1ebe6480f70993ae6ffdc95845e7e65529b7a6a","observation_id":"e693a695-8dfa-455c-96f3-26882d34f732","resolution":{"observed_at":"2026-08-12T18:18:07.016246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13304","last_updated":"2024-01-15T21:54:28Z","snapshot_observed_at":"2026-08-13T10:48:32.813378Z","submitted_at":"2023-07-25T07:44:06Z","title":"QuIP: 2-Bit Quantization of Large Language Models With Guarantees","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13304","snapshot_observed_at":"2026-08-12T18:18:05.311475Z","title":"QuIP: 2-bit quan- tization of large language models with guarantees,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.311475Z"},"links":{"cited_paper":"/paper/2307.13304","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:9fcd95796925d9d4561288272f9fafa9ceeef9c238ea0658ed8f40a1235fbcf0","observation_id":"c8357a80-ce17-4376-8e94-8a10bda052d8","resolution":{"observed_at":"2026-08-12T18:18:05.311475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11062","last_updated":"2025-05-19T06:20:01Z","snapshot_observed_at":"2026-08-13T19:22:45.524352Z","submitted_at":"2024-07-10T17:53:30Z","title":"EfficientQAT: Efficient Quantization-Aware Training for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11062","snapshot_observed_at":"2026-08-12T18:18:05.317424Z","title":"EfficientQAT: Efficient quantization-aware training for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.317424Z"},"links":{"cited_paper":"/paper/2407.11062","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:c7629123838ac5bf08024f167444aedd1d1131a8e5cb519fe01af3a613262ffb","observation_id":"479af3e7-051c-426f-9b63-c405f4b01b9a","resolution":{"observed_at":"2026-08-12T18:18:05.317424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.996063Z","title":"BBS: Bi-directional bit-level sparsity for deep learning acceleration,","venue":null,"work_id":"6a5ef273-4346-4cef-9516-4fecb767fee9","year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.323687Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:3955a36330718432c9a1d7710651b4b02d55fbbc64bbac66f23f9309c5bad84e","observation_id":"2dccfd08-f436-4a41-9d2f-7da58dade405","resolution":{"observed_at":"2026-08-12T18:18:07.001260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-12T18:18:05.334165Z","title":"Think you have solved question answering? try ARC, the ai2 reasoning challenge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.334165Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:bc1acd11314786852e0c1f2b1144db1d4d2a74ef204ca567883f5e691303305f","observation_id":"cee050f3-4088-47be-b257-5ebbad780cd2","resolution":{"observed_at":"2026-08-12T18:18:05.334165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.981162Z","title":"VS-Quant: Per-vector scaled quantization for accurate low-precision neural network inference,","venue":null,"work_id":"d9edf1a6-6b5f-46c2-a744-721810ab8f3e","year":2021},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.339536Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:f432dd7f560b5a5d5381cbfdc977189994cddfee7b24a4df5225c3c25ade7a77","observation_id":"8dd416d3-fa3a-4749-bfbb-8be9bd237287","resolution":{"observed_at":"2026-08-12T18:18:06.985768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07339","last_updated":"2022-11-10T18:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-15T17:08:50Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07339","snapshot_observed_at":"2026-08-12T18:18:05.345398Z","title":"LLM.int8(): 8-bit matrix multiplication for transformers at scale,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.345398Z"},"links":{"cited_paper":"/paper/2208.07339","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:26eefba84ccc6689f0da7c59b0dd4a4bf418baf5d12da36b27f9419d440a2d58","observation_id":"3ee0bdbf-5c80-4a4f-a57f-37e70919a3b5","resolution":{"observed_at":"2026-08-12T18:18:05.345398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02861","last_updated":"2022-06-20T16:05:15Z","snapshot_observed_at":"2026-08-14T11:59:04.372290Z","submitted_at":"2021-10-06T15:43:20Z","title":"8-bit Optimizers via Block-wise Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.02861","snapshot_observed_at":"2026-08-12T18:18:05.352436Z","title":"8-bit optimizers via block-wise quantization,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.352436Z"},"links":{"cited_paper":"/paper/2110.02861","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:2f47bdb586d789b6c34dbbd2bb19a9450f1ffde16d595dfb02873929ebb03cf4","observation_id":"5d175240-32ff-4a1c-b08a-03049c74372f","resolution":{"observed_at":"2026-08-12T18:18:05.352436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-08-13T23:56:42.354755Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-12T18:18:05.360468Z","title":"QLoRA: Efficient finetuning of quantized llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.360468Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:8e6d368377809170640787f877322db951318a64bd9643224ff2ff429ba9653d","observation_id":"d5de9375-3bab-4329-9031-273fd6e52c1e","resolution":{"observed_at":"2026-08-12T18:18:05.360468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.966135Z","title":"Documenting large webtext corpora: A case study on the colossal clean crawled corpus,","venue":null,"work_id":"590c4b8c-5edf-47a2-a925-37f6157df706","year":2021},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.369228Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:22ae4eb7fe261a3fdef547f6102397776028d00de86d54ef140fef5f9936c544","observation_id":"8db960d5-1417-4ef1-adb4-636f12b28563","resolution":{"observed_at":"2026-08-12T18:18:06.971045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03103","last_updated":"2024-06-10T23:41:18Z","snapshot_observed_at":"2026-08-13T00:14:23.764764Z","submitted_at":"2024-05-06T01:39:59Z","title":"Learning from Students: Applying t-Distributions to Explore Accurate and Efficient Formats for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03103","snapshot_observed_at":"2026-08-12T18:18:05.378635Z","title":"Learning from students: Applying t-distributions to explore accurate and efficient formats for llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.378635Z"},"links":{"cited_paper":"/paper/2405.03103","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:fd078043bcae73402a4fcb00007379a4ef0110058aca89fdb731be0e2e59d3b6","observation_id":"b6cda7ca-1185-4e43-876d-878d71f5eb86","resolution":{"observed_at":"2026-08-12T18:18:05.378635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-11T21:19:33.078277Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-12T18:18:05.384374Z","title":"GPTQ: Accurate post-training compression for generative pretrained transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.384374Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:f9d56886d825b78406722863d9970b22cc41bcbe7e1a3cdac40b28ec21d9a507","observation_id":"3545e30f-95d4-4a26-bbc4-f21d6b72dc04","resolution":{"observed_at":"2026-08-12T18:18:05.384374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.950867Z","title":"A framework for few-shot language model evaluation,","venue":null,"work_id":"d8f28772-4d1c-42cb-ab19-48809cb1f2e5","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.390678Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:051ee2a8229c705252ff7f82eb7e5db07d7ecc3f3eb7046117a05c9ee7c162c5","observation_id":"ddfe7364-2d0d-436f-ab60-51c3a907f32d","resolution":{"observed_at":"2026-08-12T18:18:06.955989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:05.403258Z","title":"Ai and memory wall,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.403258Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:3ee90d0496c233c939d4e1a5c4ffbbff71bb981f778c89399774544798fda200","observation_id":"be480d8e-aee2-44cd-b3a2-f461bf46836d","resolution":{"observed_at":"2026-08-12T18:18:05.403258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.924359Z","title":"SparTen: A sparse tensor accelerator for convolutional neural net- works,","venue":null,"work_id":"e0baa752-853a-4992-9e7c-69efc8b416b8","year":2019},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.409046Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:0273e4b34c57b22cd1267fcc81cbfcd219cbb6662600e93b09006b0b2aaf93e3","observation_id":"f0a69e1c-d141-402f-b7f2-99c277903d3e","resolution":{"observed_at":"2026-08-12T18:18:06.929217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.909209Z","title":"Eureka: Efficient tensor cores for one-sided unstructured sparsity in dnn inference,","venue":null,"work_id":"d79d9a2a-f802-4ed9-8c0d-771c0a2fed2b","year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.413936Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:f2fdc0e08f257ad34f3cb8bffae0a6c86ebd15a444ec1ca3e1507ad6a8c5fe39","observation_id":"0d38f1b3-3691-420e-aee0-19b0f326cda5","resolution":{"observed_at":"2026-08-12T18:18:06.914369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.894562Z","title":"OliVe: Accelerating large language models via hardware-friendly outlier-victim pair quantization,","venue":null,"work_id":"aa52a606-de51-4f14-97d6-8f9ae44a326b","year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.420014Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:2318d2ea577191a687747c49224c2422c8bb5b129ff1ef931f77dfff7f3e2320","observation_id":"e73d0ec0-f500-4865-9674-ce9d76d013be","resolution":{"observed_at":"2026-08-12T18:18:06.899467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.876984Z","title":"ANT: Exploiting adaptive numerical data type for low-bit deep neural network quantization,","venue":null,"work_id":"f285dd87-0dcb-4dab-acc4-ea5850f86920","year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.426405Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:0121ae46e49ff3afe88e5c3e489af38be9070415c5e6ef195c2cd3c76e3c0172","observation_id":"f5e1e0db-32d5-40fd-b2f0-64bbb5dd0d49","resolution":{"observed_at":"2026-08-12T18:18:06.883982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:05.433723Z","title":"FIGNA: Integer unit-based accelerator design for fp-int gemm preserving numerical accuracy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.433723Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:cc9944439a447a93f88376fa066cc5d26834a43b713d5bcfe5293ef3262dbb38","observation_id":"ee59c750-11f7-459f-9815-ebfb865b8435","resolution":{"observed_at":"2026-08-12T18:18:05.433723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.851459Z","title":"Stripes: Bit-serial deep neural network computing,","venue":null,"work_id":"5c525455-9ba0-4b86-8cdc-a0db6cf01fd9","year":2016},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.440602Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:37cdb474115384288d9d5f8032bf14a7a7cd601dbe74adf9255fc1b8014a11b2","observation_id":"2a54e312-1d68-430f-975c-db83cf9d2b67","resolution":{"observed_at":"2026-08-12T18:18:06.857184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.836164Z","title":"DRAMsim3: A cycle-accurate, thermal-capable dram simulator,","venue":null,"work_id":"3ae991e9-687f-4e87-9ac1-39d8414d5051","year":2020},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.447222Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:f563023dd6106db36447faee0bef7ff0e5465dc0a2e03ea723c75eff8537e319","observation_id":"c003ceb1-e834-4fa9-a93f-2963c7bb798f","resolution":{"observed_at":"2026-08-12T18:18:06.841526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.821752Z","title":"AWQ: Activation-aware weight quanti- zation for llm compression and acceleration,","venue":null,"work_id":"0d8f7828-cbb4-4048-8ba6-037f80354967","year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.452627Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:28b3ad4752a7e5bb3d443857c4ee2713319366b4d1de0f24569367dfb38661ff","observation_id":"c7bfffa2-5e67-44db-af87-c87d603e6992","resolution":{"observed_at":"2026-08-12T18:18:06.826244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-13T11:30:33.812255Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-12T18:18:05.459059Z","title":"LLM-QAT: Data-free quan- tization aware training for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.459059Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:a8387970c8f0a1018a9d5d7c40266cc9206f16208ebee05367915c5df091b2fe","observation_id":"d62349f3-65fb-469f-a062-cce71e198d54","resolution":{"observed_at":"2026-08-12T18:18:05.459059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.807616Z","title":"Torch2Chip: An end-to-end customizable deep neural network compression and deployment toolkit for prototype hardware accelerator design,","venue":null,"work_id":"66f22718-22a4-4b7b-9618-debe8470588d","year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.464500Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:971b781bc30148903362dd5e93ef31c48e61c5ecbfd7e53b9b23f37f5add4706","observation_id":"f5a1814d-ea1c-46dd-a8c9-d88538f1ba26","resolution":{"observed_at":"2026-08-12T18:18:06.812130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-12T18:18:05.469720Z","title":"Pointer sentinel mixture models,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.469720Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:ebadca68d5bf9c61224ee3ab4c51338d9ce1e3fa3c3082b81e1b262035a29ec0","observation_id":"5b3eedc9-d35b-4eb3-b600-5fc5a3d69f79","resolution":{"observed_at":"2026-08-12T18:18:05.469720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.793460Z","title":"Meta llama","venue":null,"work_id":"7ae4cb09-8d3d-4b1b-80b8-130debd04110","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.475392Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:4dbf74aa67a36082773793ddb35496b9a4d936da5627602fd35f501e720e8c16","observation_id":"81d9296d-5f45-4c8d-863f-3f33405fbfd7","resolution":{"observed_at":"2026-08-12T18:18:06.797973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.777579Z","title":"Meta llama 3","venue":null,"work_id":"3062e7a6-b89d-4b64-98d8-cd9d133f81a1","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.480490Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:e26fc75514304660952c816f502ac82263104969822c4478cddb46735dfa83bf","observation_id":"16847e1a-113b-4511-9d86-e791d99069ae","resolution":{"observed_at":"2026-08-12T18:18:06.782651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.761950Z","title":"microsoft/phi-2","venue":null,"work_id":"bbfec49f-b7f4-4b57-b85c-0db288b27f39","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.486820Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:5828ad87fa225042380d2026c2ff20369a1dc04385ab6bb6b45e091a8d944cc2","observation_id":"403f10ea-6298-4d20-b183-be7cc6748a9a","resolution":{"observed_at":"2026-08-12T18:18:06.767329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.746249Z","title":"Jetson TX2 Module","venue":null,"work_id":"55268afd-1a9b-471a-b423-6328a6acf115","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.492944Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:ba9aa8f4ebcae79127166631c6ccc515249936d40e7cb5b3e7ea86306b388ea8","observation_id":"b725fec7-f52c-423a-8b77-a3f1e5b557ea","resolution":{"observed_at":"2026-08-12T18:18:06.752027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.731073Z","title":"OCP Microscaling Formats (MX) Specification","venue":null,"work_id":"637b6bee-f0cd-4a1f-b88e-c50f7c567753","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.498944Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:78960b0b55fcbab304576bf3c8105c0afe256ee87ebde3aba05601d16b567f6d","observation_id":"c80b6c48-46be-4ec0-a7e5-2730e6c31b47","resolution":{"observed_at":"2026-08-12T18:18:06.736192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.716373Z","title":"Energy-efficient neural network accel- erator based on outlier-aware low-precision computation,","venue":null,"work_id":"f6a8d561-3b1e-46e7-b2cb-a8020bf294cb","year":2018},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.503531Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:bc32ed32a0ed05f8c0fa9dbb2f7d8b1a590cbdd347dc1a65b9acd7d164d442a8","observation_id":"c30a3d7d-d8fc-43e4-9b0b-ef928c26f6e8","resolution":{"observed_at":"2026-08-12T18:18:06.721280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.701690Z","title":"With shared microexponents, a little shifting goes a long way,","venue":null,"work_id":"8e34f54c-c179-4428-a8d0-5e14b90d284b","year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.508386Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:3f1c9c83b92185ee7893bd50bed23934ae030cd45aaf956fabc8b7fd4459d50a","observation_id":"517ccf45-9858-4d36-b639-26515244142c","resolution":{"observed_at":"2026-08-12T18:18:06.706445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10641","last_updated":"2019-11-21T19:01:32Z","snapshot_observed_at":"2026-08-14T04:48:01.875703Z","submitted_at":"2019-07-24T18:11:59Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10641","snapshot_observed_at":"2026-08-12T18:18:05.513379Z","title":"WinoGrande: An adversarial winograd schema challenge at scale,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.513379Z"},"links":{"cited_paper":"/paper/1907.10641","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:a41ae623fde1cdccac24fffda78dca9fd3568518fc0feea3a8f2b7e2e0d8914b","observation_id":"2e0409e3-f551-44da-b734-00bd9a9c074b","resolution":{"observed_at":"2026-08-12T18:18:05.513379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13137","last_updated":"2024-03-18T05:33:22Z","snapshot_observed_at":"2026-08-15T10:44:06.141247Z","submitted_at":"2023-08-25T02:28:35Z","title":"OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13137","snapshot_observed_at":"2026-08-12T18:18:05.519077Z","title":"OmniQuant: Omnidirectionally calibrated quan- tization for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.519077Z"},"links":{"cited_paper":"/paper/2308.13137","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:07605212ccffcb2233b7448bfb4fa2cca777cf984c291fb11571bc9d5f224a07","observation_id":"a457cf58-7723-45a9-9ada-8dc7e4b8e1bc","resolution":{"observed_at":"2026-08-12T18:18:05.519077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.685568Z","title":"Laconic deep learning inference acceleration,","venue":null,"work_id":"1371798e-bf5b-43ae-8391-6cd9a4e12d80","year":2019},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.524007Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:15e151d75d44cb42876a81da3a03ce2343988b972448c8905d75eec6b8fc4d65","observation_id":"8a532866-447d-4e22-a875-5c451cf1c976","resolution":{"observed_at":"2026-08-12T18:18:06.691090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.669121Z","title":"FlexGen: High-throughput generative inference of large language models with a single gpu,","venue":null,"work_id":"fd32da9d-d504-491f-b770-0eefb1d14097","year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.529127Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:28d91c35deeaa5f3e64ccd113bd55b19f4096fc9c8b97b979dbb3aad410a3e4e","observation_id":"75846753-f325-412f-be10-30a2118b1a66","resolution":{"observed_at":"2026-08-12T18:18:06.675090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.653734Z","title":"BitWave: Exploiting column-based bit-level sparsity for deep learning accelera- tion,","venue":null,"work_id":"ece030e3-4cd5-46d6-9a42-c77e8faa5054","year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.534987Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:ccab4cfa2b683de92e26a67d081600d31ce8173fcec708462df94504b59db027","observation_id":"ced9e45b-9af1-4385-b3fd-e58832ef088a","resolution":{"observed_at":"2026-08-12T18:18:06.658690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.636448Z","title":"Recursive deep models for semantic compositionality over a sentiment treebank,","venue":null,"work_id":"9fc69d6b-0361-4ba8-b9d7-88bae7550ff6","year":2013},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.539784Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:18ff6fbb979e26d9b7368cadb7fd74621d6f86ae644453a3217d4bd4e2bef696","observation_id":"c2cd6ec7-6458-40c1-a668-fbba858da6da","resolution":{"observed_at":"2026-08-12T18:18:06.642088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T18:18:05.544497Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.544497Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:aff649ca61de38d01a721171219f16c32c7b320fb6198f370f9ee495d370fd3a","observation_id":"5745f5c3-a3f5-44d5-869b-5d1251baba60","resolution":{"observed_at":"2026-08-12T18:18:05.544497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.620583Z","title":"Dual-side sparse tensor core,","venue":null,"work_id":"fba38cd0-1a26-4471-9633-48547c525b20","year":2021},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.549285Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:0d201a84728895d1e53bfa51185db2d1db96c089bb1bb8b396c5f8035841a305","observation_id":"ded4225a-9a55-406d-a7e9-75474353d037","resolution":{"observed_at":"2026-08-12T18:18:06.625619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08583","last_updated":"2023-12-18T05:08:23Z","snapshot_observed_at":"2026-08-13T05:02:51.919776Z","submitted_at":"2023-12-14T01:06:37Z","title":"ZeroQuant(4+2): Redefining LLMs Quantization with a New FP6-Centric Strategy for Diverse Generative Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08583","snapshot_observed_at":"2026-08-12T18:18:05.554103Z","title":"ZeroQuant(4+2): Redefining llms quantization with a new fp6-centric strategy for diverse generative tasks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.554103Z"},"links":{"cited_paper":"/paper/2312.08583","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:f9eb67c4b8d24e8e7cfac70e238be75e2a5ab0be32857601e834d116cbe081cb","observation_id":"ba4a69c7-6dba-4c8d-8c65-c2e4ab1dcced","resolution":{"observed_at":"2026-08-12T18:18:05.554103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.603622Z","title":"HighLight: Efficient and flexible dnn acceleration with hierar- chical structured sparsity,","venue":null,"work_id":"832b4a6d-395c-476b-b181-7f69b8fc3f7d","year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.559461Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:a9e616f47eba1f1516c828ed57c41c4abfd253a5453e21499f0a5257cfc21ed2","observation_id":"6794c968-4311-451b-82f0-869deebffd6e","resolution":{"observed_at":"2026-08-12T18:18:06.609183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.587424Z","title":"Quant-llm: Accelerating the serving of large language models via fp6- centric algorithm-system co-design on modern gpus,","venue":null,"work_id":"f541d23e-7fa8-4c38-b160-776e9c420947","year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.564896Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:ba17b337fce0437f5c8d6ad3a3eac2d048a4348dd390ea53224e531d176a3c85","observation_id":"81bf2abb-2e50-4d24-94fe-15fb05766beb","resolution":{"observed_at":"2026-08-12T18:18:06.592575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10438","last_updated":"2024-03-29T19:21:58Z","snapshot_observed_at":"2026-08-15T13:13:36.205705Z","submitted_at":"2022-11-18T18:59:33Z","title":"SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10438","snapshot_observed_at":"2026-08-12T18:18:05.569895Z","title":"SmoothQuant: Accurate and efficient post-training quantization for large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.569895Z"},"links":{"cited_paper":"/paper/2211.10438","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:7d0bc972fcc211c0b2833fe030950df55ec7de1a0e282a1f63754364285b658f","observation_id":"e1de944c-da81-4f81-af23-5ee1f9ed88ae","resolution":{"observed_at":"2026-08-12T18:18:05.569895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01861","last_updated":"2022-06-04T00:28:21Z","snapshot_observed_at":"2026-08-14T22:20:42.170453Z","submitted_at":"2022-06-04T00:28:21Z","title":"ZeroQuant: Efficient and Affordable Post-Training Quantization for Large-Scale Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.01861","snapshot_observed_at":"2026-08-12T18:18:05.575588Z","title":"ZeroQuant: Efficient and affordable post-training quantization for large- scale transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.575588Z"},"links":{"cited_paper":"/paper/2206.01861","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:e81fbdc0bb0b93a9f5fbfcca92c1389ef6f2777581c6494dfed4bf30cf7331a4","observation_id":"405b02e5-3090-4efd-b4dc-2c5bd61b737b","resolution":{"observed_at":"2026-08-12T18:18:05.575588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.571600Z","title":"GOBO: Quantizing attention-based nlp models for low latency and energy efficient inference,","venue":null,"work_id":"9c7af972-1fb7-40be-b62c-e5322a39945f","year":2020},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.581299Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:49d0b66a23c6b3aca8f41bfe4974f2dad372a8b7a48e8cf6af28875165e7b4bf","observation_id":"606dc756-95a5-425d-9d03-5d5496ea83f8","resolution":{"observed_at":"2026-08-12T18:18:06.576515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.554720Z","title":"Mokey: enabling narrow fixed-point inference for out-of-the-box floating-point transformer models,","venue":null,"work_id":"2abf583a-cba7-41ce-9e0e-30d639f188c9","year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.585855Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:4b1fcb0b3779628850a9c502402cbbae78262e00f66df0fed5544d20cc51352d","observation_id":"5148d089-888a-4569-a368-292371c62538","resolution":{"observed_at":"2026-08-12T18:18:06.560040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.539779Z","title":"HellaSwag: Can a machine really finish your sentence?","venue":null,"work_id":"25890435-78b4-4fdd-8acd-972008080955","year":2019},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.591745Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:69c1500c300d5be60a0f0385eca6d1c554a1d45af6f356d84aca5640cdfb626b","observation_id":"a8477de0-8536-4c58-b2bc-256281b524e6","resolution":{"observed_at":"2026-08-12T18:18:06.544396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-12T18:18:05.596760Z","title":"Opt: Open pre-trained transformer language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.596760Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:02529bc3b7d58ff94bd8070b458315b4183b828ac90c6bf81e9e3d588c08e24e","observation_id":"6d2025b9-d479-43f7-a13b-0019896050f4","resolution":{"observed_at":"2026-08-12T18:18:05.596760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.524434Z","title":"Atom: Low-bit quantization for efficient and accurate llm serving,","venue":null,"work_id":"06b70d18-a202-4f8d-bc6e-b10ac03ef098","year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.602575Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:4336984d58b915bf1e5666ce864ba8c2d79bee44c9bedf779e4f64b4448f4b6d","observation_id":"7071b34d-afad-42e3-8527-b25bc1cc1da9","resolution":{"observed_at":"2026-08-12T18:18:06.529242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:05.607280Z","title":"Cambricon-S: Addressing irregularity in sparse neural networks through a cooperative software/hardware approach,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.607280Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:8304ebc6ec582497abf5b52d8647dec76497784426f0df1a7b831db8b9147489","observation_id":"3303371c-20b0-4fce-abae-616bb3a6d52b","resolution":{"observed_at":"2026-08-12T18:18:05.607280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.499361Z","title":null,"venue":null,"work_id":"3ed849fe-6823-4452-882b-ec40fd9dea83","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.612063Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:1a762db1e0b89f2bf805d323c86dc6b9ab5cdab3ab14bc5dbe92934673aa36de","observation_id":"36f6281a-0d00-4f7d-901a-4a42eb74069e","resolution":{"observed_at":"2026-08-12T18:18:06.503921Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.483036Z","title":null,"venue":null,"work_id":"2144be9a-6bdb-4220-ac68-c705ecd0dfc8","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.616663Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:388728e0bf7010c8105aa8415359595121dc68260e5e65ba216cbbd2bf6a593a","observation_id":"78bb736f-fabf-47bd-b937-bd5f66bcb390","resolution":{"observed_at":"2026-08-12T18:18:06.489162Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"records/1425253","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:05.838521Z","title":"The quantization experiments require CUDA","venue":null,"work_id":"8c9119d2-1a92-495a-b002-efc3b8d533ec","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.621575Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:1d85752889352d5d5d2962a058df18b4e983f1bbc0444616f19cf203f93d5e80","observation_id":"b7bc8668-c63e-4388-8e12-71a83e1db210","resolution":{"observed_at":"2026-08-12T18:18:05.847885Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.466653Z","title":"This can reproduce the results in Table VI and Table VIII","venue":null,"work_id":"6816721b-a7d8-4b65-8aa4-2f2952c59741","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.627026Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:ea8242104233903939e1d0a4f0cefd84fd1e624b5849ecedd1193bb397e1be30","observation_id":"7ef2cb9f-aa8c-4bd1-9b74-f3a7bf0e05f9","resolution":{"observed_at":"2026-08-12T18:18:06.472199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.450397Z","title":"This can reproduce the results in Fig","venue":null,"work_id":"caec9589-52d7-413b-9047-f606bde04fce","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.632438Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:5fd03d5cd0cfb8126ddbf9f4f4eaaa27f2559823fc0940f9aac4b4a199173bf4","observation_id":"4fda59cd-4fda-4ed0-83ef-5322340e1d73","resolution":{"observed_at":"2026-08-12T18:18:06.455376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.433825Z","title":"This can reproduce the AWQ results in Table XI","venue":null,"work_id":"8e5a1872-c5d8-4f19-beae-99a14b178440","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.638201Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:0a62f9b24d10de582dbf1ac6ad5372ef9bccda7fc0e06c09048e4f04a4ef4713","observation_id":"ccab6954-7b06-4598-a270-b80f437b9928","resolution":{"observed_at":"2026-08-12T18:18:06.439448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.418950Z","title":"This can reproduce the OmniQuant results in Table XI","venue":null,"work_id":"0554ae4c-a1db-454c-948d-c2c9e794bb42","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.643669Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:8c8aa27e8c92f520cc257f6e29f2073c67be4d615d15b7839c034219654ca9fc","observation_id":"04b6b87e-c3f0-4157-a89b-5fbe856fd78c","resolution":{"observed_at":"2026-08-12T18:18:06.423721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.403815Z","title":"This can reproduce the results in Table XII","venue":null,"work_id":"43c37ca8-0000-4443-ac17-c2540b9a487b","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.650161Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:8c1f0c987df2edd2115a9efe8ccaaedf3a44667d194ae7eff3257bb3984ec918","observation_id":"c92366f4-f3f2-4e23-92e4-787655a12532","resolution":{"observed_at":"2026-08-12T18:18:06.408812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.387731Z","title":"$ cd bitmod quant $ conda activate awq−bitmod In ‘ run_exp.sh’, modify the ‘ export’ command by specifying the HuggingFace home directory, ‘ HF_HOME’, on your computer","venue":null,"work_id":"bb505671-48c4-4814-815e-02d046e540bc","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.655713Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:c612ba683a22778849a040e0acfe47d46fed5de3741faa6eb0ac9249fcff5338","observation_id":"4507a61e-6769-434b-bce8-d90d75325cd4","resolution":{"observed_at":"2026-08-12T18:18:06.392812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.372804Z","title":"When enabled / disabled, it will evaluate the hardware performance of generative / discriminative tasks","venue":null,"work_id":"40fa30a9-2325-40fd-bc8b-9224c955b2ea","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.661738Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:e9283eca4a6c568f7ea244d53fbd7ff271de6cb0003592e80f4139323d3c784f","observation_id":"b335f717-f077-4227-9607-3bc27e81bae1","resolution":{"observed_at":"2026-08-12T18:18:06.377663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.357980Z","title":"You can compare these with the AWQ results in Table XI","venue":null,"work_id":"2e694fae-6870-4d74-805a-6bd9012bb83c","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.666231Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:73e41f39b1b40acdc21b3acce3b5c622aa7432bc9ed165af781865c215b0484c","observation_id":"6a3efef1-2698-4d18-842d-329571d40167","resolution":{"observed_at":"2026-08-12T18:18:06.362976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.342745Z","title":null,"venue":null,"work_id":"600d676b-69e1-4034-a5d9-460fd63372ad","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.672332Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:1f0bc0f047b770fa61fda1d2f4fd0650e214ef2ebac6aae1f97af251a1c3b070","observation_id":"4a30bf33-4317-4d58-adb4-51ffd951a815","resolution":{"observed_at":"2026-08-12T18:18:06.347977Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.326017Z","title":"You can compare these results with the SmoothQuant results in Table XII","venue":null,"work_id":"28025997-fa99-436e-bb3a-7d0de34e8276","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.679560Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:da3b31ae83c9076b6d27d2738c8c32a2ff9d16d83b14c930d54678caabf7d3ff","observation_id":"607bbf41-894b-4510-b912-b78731f0a07c","resolution":{"observed_at":"2026-08-12T18:18:06.331716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.308736Z","title":null,"venue":null,"work_id":"280aec4c-3b34-4f22-9a55-ad538df17cf2","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.684331Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:2030815dab30b7677ee94ad3ba9706be50a3ae24b5ad35cf7b7184446ec19e85","observation_id":"28788e20-1a97-4a3f-8bcd-8009204c5ae3","resolution":{"observed_at":"2026-08-12T18:18:06.314620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.291676Z","title":"7 and Fig","venue":null,"work_id":"6e37533a-73df-4281-add0-5008c5d4bbaf","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.689471Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:a69df903ea0c1c7b73a2fc67b060e4a5bb2ddfbb33f27ec00a37d6e21313a570","observation_id":"38334d65-423d-4216-acd0-2b1ac721a5f5","resolution":{"observed_at":"2026-08-12T18:18:06.297037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.276186Z","title":null,"venue":null,"work_id":"8a5bdec4-6d49-42f2-a290-af38407053c7","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.695924Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:4f0e8461048f8f45df9bee9d4405c4c0607de70311ffb33d3a458d51e3948c52","observation_id":"8da12c5d-9ead-487d-a3d2-5fd3b0df19fa","resolution":{"observed_at":"2026-08-12T18:18:06.280993Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.260454Z","title":null,"venue":null,"work_id":"337afd62-144a-4f3f-8936-80dfc7e6bc21","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.701068Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:552710bf65f3c4836a104aac77bfc939213eaa40316c68d458f2725cdc00aabe","observation_id":"97cd8206-4895-4bee-9b4d-ff9670629902","resolution":{"observed_at":"2026-08-12T18:18:06.265003Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.244721Z","title":null,"venue":null,"work_id":"e49b2c29-f9d9-4de1-9270-3d9c27ee2fdb","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.706979Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:93944c726b55698b88c73c06da75528e9fdfe0b60fa2ca999cbeb2b9120c67c5","observation_id":"9b868ba6-42a4-4fa5-91b8-220b93c04e97","resolution":{"observed_at":"2026-08-12T18:18:06.250285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:05.398440Z","title":"Available: https://zenodo.org/records/10256836","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.398440Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:5fd564d8bf7a707065442e90528ca116c1fede71abbe14bc888aff3b33ade10d","observation_id":"44b1c974-e20b-4d19-8cc4-f47a8ac52edb","resolution":{"observed_at":"2026-08-12T18:18:05.398440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":2,"verified_fuzzy":46},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 1 inbound Pith citation observation for arXiv:2411.11745."}