{"as_of":"2026-08-14T23:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:143736799695804dc655949a20f1a9d9b09a2c747299c24f6a76a1734463b7f2","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:15:34.047943Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.23035/citation-record","integrity":"/paper/2507.23035/integrity","json":"/paper/2507.23035/citation-record.json","paper":"/paper/2507.23035"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T11:15:33.805847Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.805847Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:990eeace04324557c1e11014c71967ddd49f74e6a2e2f5c13c2c00a181b2afbe","observation_id":"847f1ac4-5c7d-4ff8-a611-3eab56f97699","resolution":{"observed_at":"2026-08-06T11:15:33.805847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.576174Z","title":"Introducing nvfp4 for efficient and accurate low-precision inference,","venue":null,"work_id":"75d34317-3824-4265-a740-9263c0f03813","year":2025},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.809417Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:385412695287609409543b3d99431ad831498ce8b3d5f4541d81f5ff13b85244","observation_id":"1d4a66b1-8c6c-41c6-8bb1-b40af839071f","resolution":{"observed_at":"2026-08-06T11:15:34.579336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-13T00:40:50.161960Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-06T11:15:33.906211Z","title":"Quarot: Outlier-free 4-bit inference in rotated llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.906211Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:26023a3dd65f049f625a457d2e45f0e21ad3d6fd3a365550d0cec09c520e433a","observation_id":"ffa98e14-2ef6-4e5b-8568-ab043fda4390","resolution":{"observed_at":"2026-08-06T11:15:33.906211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:33.909765Z","title":"Piqa: Reasoning about physical commonsense in natural language,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.909765Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:37e95bc3943a25e93e1234b3069f257f88597d72975e28b3b4b41403f5aba01a","observation_id":"26c611be-c7b4-4e90-b0c5-c42224593a74","resolution":{"observed_at":"2026-08-06T11:15:33.909765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:33.913219Z","title":"Language mod- els are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.913219Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:9e69a871dc54a1a60c8f88412002926105d192ed69b524d0a310a0630fcb073a","observation_id":"676550be-860f-4102-8a7d-8e7a3e331415","resolution":{"observed_at":"2026-08-06T11:15:33.913219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:33.916602Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.916602Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:0e92c73b43461555eb90fb9e37d98cd8e4f5479b14e50febeacaddfdcb296aa1","observation_id":"11615361-3187-4929-bfd6-389b93b435c4","resolution":{"observed_at":"2026-08-06T11:15:33.916602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-06T11:15:33.920077Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.920077Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:2f08b60c8ffb7eabe3fb64943cb223233c5bb5e0edd9e7339606e685839d8ad0","observation_id":"091fade5-25e8-4b5c-b535-1174f1e6af4d","resolution":{"observed_at":"2026-08-06T11:15:33.920077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.557755Z","title":"Nvidia rtx blackwell gpu architecture: Built for neural rendering,","venue":null,"work_id":"cd7f320d-8f9c-4380-a843-4b04b78efe9b","year":2025},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.922395Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:d37d42c201dc0fc2f86d69cb1b593136f0ea89bde45db0de028af6a787a0a3cd","observation_id":"9ba754d0-ccb3-48ad-ac87-d48b1cd9cb79","resolution":{"observed_at":"2026-08-06T11:15:34.560155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08758","last_updated":"2021-09-30T17:20:01Z","snapshot_observed_at":"2026-08-11T11:33:47.725577Z","submitted_at":"2021-04-18T07:42:52Z","title":"Documenting Large Webtext Corpora: A Case Study on the Colossal Clean Crawled Corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08758","snapshot_observed_at":"2026-08-06T11:15:33.925142Z","title":"Documenting large webtext corpora: A case study on the colossal clean crawled corpus,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.925142Z"},"links":{"cited_paper":"/paper/2104.08758","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:228a86e1b38604496213e9ed4fa3454297c8f9a4b3464156e77562454a7be9b4","observation_id":"c19aadb0-2152-4b45-8a97-5b20991a2b7e","resolution":{"observed_at":"2026-08-06T11:15:33.925142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-11T21:19:33.078277Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-06T11:15:33.931222Z","title":"Gptq: Accurate post-training quantization for generative pre-trained transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.931222Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:bf7c9481561450245eba064e591d610df32ac1a4f04a522d1c743968ff5443c7","observation_id":"0bd92ba3-0419-4950-820f-d15dca7882e6","resolution":{"observed_at":"2026-08-06T11:15:33.931222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.549995Z","title":"Gpt4aigchip: Towards next-generation ai accelerator design automation via large language models,","venue":null,"work_id":"b5ab1357-010a-43c9-9947-e39dc9733b9d","year":2023},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.934030Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:1181c9db1eef9b841c8e5eeb641712cc87d79eabd8ad59196a2d3f8039049307","observation_id":"b66d7ef3-3d63-40c7-a76c-b41da2412312","resolution":{"observed_at":"2026-08-06T11:15:34.552522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:33.937039Z","title":"The language model evaluation harness,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.937039Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:89d74b3b94e6233075150f7e58408d13aa135e8e2517b5c435e37cdb392495dd","observation_id":"83587800-befc-4eef-973a-acb387a7edb1","resolution":{"observed_at":"2026-08-06T11:15:33.937039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.541799Z","title":"Disaggregated machine learning via in-physics computing at radio frequency,","venue":null,"work_id":"d606c896-df5e-43be-8194-407c3b105bd6","year":2026},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.939378Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:ab12828d2a59e3282ab4847782df9fccd6aebedd7e235b8d5d87e3c52e01bde9","observation_id":"01476bca-db5c-4939-ade7-9ff0cef4583e","resolution":{"observed_at":"2026-08-06T11:15:34.544343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T11:15:33.941385Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.941385Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:fc7b673be6f90bda2b5118462d28a95c0d28e482c28a7d03dc3450b9d5e64b03","observation_id":"0df24342-d211-44e0-b568-5c04c93ff571","resolution":{"observed_at":"2026-08-06T11:15:33.941385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:33.943889Z","title":"A survey: Collaborative hardware and software design in the era of large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.943889Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:369ef20121cc872bc93e1a393950480db2752a58a217cb4b2803b6769f02ab65","observation_id":"fa62e0b2-0f26-4eb9-9c55-b2f71afd2313","resolution":{"observed_at":"2026-08-06T11:15:33.943889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T11:15:33.945972Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.945972Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:87edd20d68319ef04b5ef9dea861b1b9941cf54d5ad7cc953726f5d72ea6c3fc","observation_id":"4bd7d299-2c50-4f70-8bda-050d8482a453","resolution":{"observed_at":"2026-08-06T11:15:33.945972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.529987Z","title":"Chateda: A large language model powered autonomous agent for eda,","venue":null,"work_id":"9b5ca17e-1dc5-4ae0-b1da-c807655f8fc3","year":2023},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.948798Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:dcc46e4fbdea0a50393d571f7880690170ebbe9059eebc566e85f70a483f4b87","observation_id":"10c1d9ca-9662-4750-87f2-957ad7e750d6","resolution":{"observed_at":"2026-08-06T11:15:34.532245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.18079","last_updated":"2025-05-28T18:58:29Z","snapshot_observed_at":"2026-08-13T04:29:50.330115Z","submitted_at":"2024-01-31T18:58:14Z","title":"KVQuant: Towards 10 Million Context Length LLM Inference with KV Cache Quantization","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.18079","snapshot_observed_at":"2026-08-06T11:15:33.951900Z","title":"Kvquant: Towards 10 million context length llm inference with kv cache quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.951900Z"},"links":{"cited_paper":"/paper/2401.18079","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:2113c3223d075101e9769449245173c0ddf9f7351de78e63a27ca5e3e3fd562f","observation_id":"b78e0d83-6f47-466f-8038-3a25652de897","resolution":{"observed_at":"2026-08-06T11:15:33.951900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T11:15:33.954140Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.954140Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:b2c216f84b6c285653db808e118b618038dfa46b56ed9ba024db9d11f1f1a6cd","observation_id":"f973aac6-c8f8-4b38-b7ec-73c49efcea13","resolution":{"observed_at":"2026-08-06T11:15:33.954140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-13T11:18:21.844753Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-08-06T11:15:33.956446Z","title":"Squeezellm: Dense-and-sparse quantization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.956446Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:18fb3b4474819af33dd3d7b7d1833e313f4e473948a16c0116e543d9a5ff8421","observation_id":"e84da4c0-1e3d-4d94-82c6-e8450d5c288a","resolution":{"observed_at":"2026-08-06T11:15:33.956446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04330","last_updated":"2024-11-30T02:42:31Z","snapshot_observed_at":"2026-08-13T16:43:49.900228Z","submitted_at":"2024-11-07T00:10:10Z","title":"Scaling Laws for Precision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04330","snapshot_observed_at":"2026-08-06T11:15:33.959039Z","title":"Scaling laws for precision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.959039Z"},"links":{"cited_paper":"/paper/2411.04330","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:ee79ec05dcb25673396613d9576ff7332ca9239877002bc3dd5246ee4a773894","observation_id":"0e91b256-0d82-4bcd-ad0d-353c4c24d757","resolution":{"observed_at":"2026-08-06T11:15:33.959039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:33.961283Z","title":"Maeri: Enabling flexible dataflow mapping over dnn accelerators via reconfigurable intercon- nects,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.961283Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:49280eb4ed71491b0fa2193432d53a07ad65ccbac5e69537b1829d9de13efac5","observation_id":"474dd206-9f2e-44dc-8e38-d267b0d2e348","resolution":{"observed_at":"2026-08-06T11:15:33.961283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:33.963596Z","title":"Efficient memory management for large language model serving with pagedattention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.963596Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:8ae49efeb7b19cc6496648187714f881717b0fcf22c69b3b4adf763b73194db3","observation_id":"fdfd1d2e-742e-4a9e-8129-4d58ba90fdf6","resolution":{"observed_at":"2026-08-06T11:15:33.963596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16442","last_updated":"2024-11-09T12:09:55Z","snapshot_observed_at":"2026-08-13T05:15:48.310655Z","submitted_at":"2023-11-28T02:44:59Z","title":"Fast and Efficient 2-bit LLM Inference on GPU: 2/4/16-bit in a Weight Matrix with Asynchronous Dequantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16442","snapshot_observed_at":"2026-08-06T11:15:33.965632Z","title":"Fast and efficient 2-bit llm inference on gpu: 2/4/16-bit in a weight matrix with asynchronous dequantization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.965632Z"},"links":{"cited_paper":"/paper/2311.16442","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:0ffb0f1065e605ce2c9b63a4e265d5268e7f8dd39462dd3b1b18e25551ed29b6","observation_id":"99348218-225c-4b9b-af02-865527d3b435","resolution":{"observed_at":"2026-08-06T11:15:33.965632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:33.967821Z","title":"Dramsim3: A cycle-accurate, thermal-capable dram simulator,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.967821Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:33b73cab46fb7e69bc057c25cbd1b5825da0dabb91416f7a3f1c576084fe23a9","observation_id":"32f0d38e-909f-4f6b-8443-288630bd664c","resolution":{"observed_at":"2026-08-06T11:15:33.967821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.506341Z","title":"Cacti- p: Architecture-level modeling for sram-based structures with advanced leakage reduction techniques,","venue":null,"work_id":"1887affd-f4a6-4c5c-b4f8-fc17e2c8ced2","year":2011},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.970382Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:28653117e674aa560008acdb9478370d5092f5f895f80c5b3ea44e51b45836bc","observation_id":"7f07b157-8cf1-464b-b7bc-77e3410a2eb4","resolution":{"observed_at":"2026-08-06T11:15:34.508718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.499631Z","title":"Duquant: Distributing outliers via dual transformation makes stronger quantized llms,","venue":null,"work_id":"347eadae-9e56-4871-9bdc-4b2ebde17fcf","year":2025},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.972847Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:d66a4fba6f41be945839cc09c3b75a126f4f2962241b3fd47a3ee9f168c588e5","observation_id":"9945d51a-502d-49c7-ab4d-69aaa5b8ce20","resolution":{"observed_at":"2026-08-06T11:15:34.502129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:33.975351Z","title":"Awq: Activation-aware weight quanti- zation for on-device llm compression and acceleration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.975351Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:8adfb9b978c4aaa046aa80ba2e41d0f1f4742e4a975aa51c267e9a9651d17ad1","observation_id":"4913921f-23cb-45be-80c3-b6e41a69d8ea","resolution":{"observed_at":"2026-08-06T11:15:33.975351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04532","last_updated":"2025-05-01T02:14:05Z","snapshot_observed_at":"2026-08-13T00:12:52.272658Z","submitted_at":"2024-05-07T17:59:30Z","title":"QServe: W4A8KV4 Quantization and System Co-design for Efficient LLM Serving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04532","snapshot_observed_at":"2026-08-06T11:15:33.977646Z","title":"Qserve: W4a8kv4 quantization and system co-design for efficient llm serving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.977646Z"},"links":{"cited_paper":"/paper/2405.04532","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:8260a64fad5d45930cfc4291e88c99c16f1b9f19af3d497cedb0fbd80427a8f8","observation_id":"6bca994c-09f1-444a-99eb-a2fe6badb1f1","resolution":{"observed_at":"2026-08-06T11:15:33.977646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16836","last_updated":"2023-10-25T17:59:32Z","snapshot_observed_at":"2026-08-13T05:40:28.721391Z","submitted_at":"2023-10-25T17:59:32Z","title":"LLM-FP4: 4-Bit Floating-Point Quantized Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16836","snapshot_observed_at":"2026-08-06T11:15:33.980434Z","title":"Llm-fp4: 4-bit floating-point quantized transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.980434Z"},"links":{"cited_paper":"/paper/2310.16836","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:b67deda8c9a1041f240b921f2436bb666903f76c7db7ad00f1ca121166f315eb","observation_id":"890a1171-f933-4662-951e-180cecf31f3a","resolution":{"observed_at":"2026-08-06T11:15:33.980434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:33.982460Z","title":"Micromix: Efficient mixed-precision quantization with microscaling formats for large lan- guage models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.982460Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:fd5d88298c5e61e1f359c57427459420910c4e7000575e380bd241ee84e13fc7","observation_id":"ae5fbade-769f-4cb2-9da3-c7f6c0eaaced","resolution":{"observed_at":"2026-08-06T11:15:33.982460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16406","snapshot_observed_at":"2026-08-06T11:15:33.984311Z","title":"Spinquant–llm quantization with learned rotations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.984311Z"},"links":{"cited_paper":"/paper/2405.16406","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:f5423ad421d3c235b26a6379b77f7e640ed635af8c3dac8c220c17de730b5a72","observation_id":"38ab1e3d-f98f-4f09-a5cd-2073a5c0d73e","resolution":{"observed_at":"2026-08-06T11:15:33.984311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.488360Z","title":"Some methods for classification and analysis of mul- tivariate observations,","venue":null,"work_id":"67792828-e4f2-4545-9290-72309ca4bf15","year":1967},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.986591Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:1adbb8a1ed2045424f9ab98730047ecf08ea83655a2b353a2b2951119017738a","observation_id":"e9c1bb92-f21a-4fc2-b7ed-f8ded2fd9925","resolution":{"observed_at":"2026-08-06T11:15:34.490903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.481840Z","title":"The penn treebank: Anno- tating predicate argument structure,","venue":null,"work_id":"ed6e430e-dc1b-4677-b8d3-e5c4af22c4dc","year":1994},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.988720Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:1c3ea223f7434d41f780e0f2373b1c7380d46cf8d48dc59a2d9539eed56a425b","observation_id":"f2ef1d18-e455-4ce2-8e0b-c4501104cd6c","resolution":{"observed_at":"2026-08-06T11:15:34.484496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-06T11:15:33.990791Z","title":"Pointer sentinel mixture models,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.990791Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:8e28b33f67f0357e59f83d75f5d085ebf30141f63489ce7b06045410fe467b62","observation_id":"53d58b4d-4c3a-4d28-9050-b01fc0c896db","resolution":{"observed_at":"2026-08-06T11:15:33.990791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:33.993051Z","title":"Lut tensor core: A software-hardware co-design for lut-based low-bit llm inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.993051Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:4079d621885d11a66f4d88c5c8361e2cec8394e76d461b36a733bab005f8de13","observation_id":"ed7a9133-be5c-4554-a0cb-2e41b845ce77","resolution":{"observed_at":"2026-08-06T11:15:33.993051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.472054Z","title":"Flexagon: A multi-dataflow sparse-sparse matrix multiplication accelerator for efficient dnn processing,","venue":null,"work_id":"6fb760aa-8714-4a4f-9486-4b151fdb6d95","year":2023},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.995396Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:373cf51371fcdfe8ac0aa4970b9e93e50fbb4246ee71a9ab1ba06f6f3511af06","observation_id":"8b5b2eea-1a5d-4e71-9f56-f8eef89ca9e1","resolution":{"observed_at":"2026-08-06T11:15:34.474197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.465577Z","title":"Tensor core performance: The ultimate guide,","venue":null,"work_id":"3ccc69ba-c78a-435e-a8d5-b3a245c7065e","year":2019},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.997491Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:4562762ff848873e66c455cad29bef099851eb882dd0c8e3e83898f3d7b07fa4","observation_id":"eac6ef34-4cf6-4290-ac41-ef9c3bcb953a","resolution":{"observed_at":"2026-08-06T11:15:34.467837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.458955Z","title":"Nvidia a100 tensor core gpu architecture,","venue":null,"work_id":"a70d715e-8934-4a01-87b7-7cfacc7b997a","year":2020},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:33.999630Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:74669883e597e2e3e641932d1c7e4fd4cd201a281ee1270e30b321f4c8fb169c","observation_id":"acaa0eff-aaa0-4ed9-ad1e-b82c1d9d7738","resolution":{"observed_at":"2026-08-06T11:15:34.461515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.452131Z","title":"Nvidia turing gpu architecture whitepaper,","venue":null,"work_id":"35c196e9-e6fb-41ce-b045-a90b0e33718a","year":2018},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.002318Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:67cde0f421bc254db8e6e70de7e8fca25bf82172b062e64424fc3e6fbcabad11","observation_id":"79775c60-7ee3-46d3-99da-2aec46b3deaf","resolution":{"observed_at":"2026-08-06T11:15:34.454754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.005265Z","title":"Figlut: An energy-efficient accelerator design for fp-int gemm using look-up tables,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.005265Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:1cc858c63c171e42f3733848c6c3977c0866368bfc12614a2b6200e04c83e5e8","observation_id":"9a5f4477-ab6c-46ce-8f59-c759b49a7646","resolution":{"observed_at":"2026-08-06T11:15:34.005265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.09557","last_updated":"2024-04-01T06:09:41Z","snapshot_observed_at":"2026-08-14T06:12:29.966982Z","submitted_at":"2022-06-20T03:48:17Z","title":"LUT-GEMM: Quantized Matrix Multiplication based on LUTs for Efficient Inference in Large-Scale Generative Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.09557","snapshot_observed_at":"2026-08-06T11:15:34.007377Z","title":"Lut-gemm: Quantized matrix multiplication based on luts for efficient inference in large-scale generative language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.007377Z"},"links":{"cited_paper":"/paper/2206.09557","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:c8ee14443b6dacb7c5b6205c9914692df135681646c57f31c491ba3425ebd85f","observation_id":"c403adaa-dcb0-43ee-ad15-14d0688474fc","resolution":{"observed_at":"2026-08-06T11:15:34.007377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.009539Z","title":"Pytorch: An imperative style, high-performance deep learning library,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.009539Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:c0c7420ee9c123c7a5c215c7a37d129b362e21efa121eb876cfce26aefa5fb33","observation_id":"c8689608-4ed0-4553-8a34-81cec0ae2380","resolution":{"observed_at":"2026-08-06T11:15:34.009539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.436066Z","title":"The spectrum of the fisher information matrix of a single-hidden-layer neural network,","venue":null,"work_id":"ba7cf429-51c4-4a13-9b00-8c4b8ed253b5","year":2018},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.011413Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:e4adc96b073f707fab3bef4d0136ebfadd5fdfe735becff934aec3bd44d5d26e","observation_id":"26c6ef4f-79ec-455a-917d-d2dd090e8f2b","resolution":{"observed_at":"2026-08-06T11:15:34.439003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-13T04:25:38.282910Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-06T11:15:34.013011Z","title":"Code llama: Open foundation models for code,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.013011Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:4355870ac7bbd90f918549bc5ec4886bc7299b02d674ebf1d75395989ec9fbd4","observation_id":"f229ea5a-8b62-487e-bfa3-3749f265cab1","resolution":{"observed_at":"2026-08-06T11:15:34.013011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.015194Z","title":"Winogrande: An adversarial winograd schema challenge at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.015194Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:80e14973bb1ead7daa1151acc854492791a32ff3d5e1a2c4cae123fbe8664563","observation_id":"5ed5fbe7-3998-44da-9c87-92171d12317a","resolution":{"observed_at":"2026-08-06T11:15:34.015194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.423871Z","title":"From high-level deep neural models to fpgas,","venue":null,"work_id":"65617535-ead5-4cbb-adf3-c4295bb70a60","year":2016},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.017582Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:6265f967b162976116fa82450447b7a7d946321c2e0d9ebc384df41ef7bacd05","observation_id":"3e8fc9e3-9e3b-42f2-93e8-fb4b672eedae","resolution":{"observed_at":"2026-08-06T11:15:34.426375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.416900Z","title":"Using tournament trees to sort,","venue":null,"work_id":"297bee13-95cc-4110-94bc-442c88f05fb6","year":1986},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.019566Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:2ec6d124d3738aea1d364242ef4c170cf779fc86aa10e893dd5bb52035e69769","observation_id":"af992595-daa8-4976-927e-11a4586467a6","resolution":{"observed_at":"2026-08-06T11:15:34.419142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-12T22:24:54.357427Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-06T11:15:34.021581Z","title":"Flatquant: Flatness matters for llm quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.021581Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:fa1dab970713d5a62b1d9cc84fc7321dca16707e9a26bb84d20ddeaabfd94afe","observation_id":"ccd3cce7-639b-436b-b6df-46d6abd5dcd6","resolution":{"observed_at":"2026-08-06T11:15:34.021581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04156","last_updated":"2024-11-06T10:28:46Z","snapshot_observed_at":"2026-08-12T22:06:36.060101Z","submitted_at":"2024-11-06T10:28:46Z","title":"Crystal: Illuminating LLM Abilities on Language and Code","version":1},"cited_work":{"arxiv_id":"2411.04156","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.04156","snapshot_observed_at":"2026-08-06T11:15:34.100289Z","title":"Crystal: Illuminating LLM Abilities on Language and Code","venue":"cs.SE","work_id":"526f4bc9-62fd-4ce5-bf8a-f984dab04174","year":2024},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.024059Z"},"links":{"cited_paper":"/paper/2411.04156","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:9ec47f8a806eb7872e51a575dc7d2d647666cc0ff867818d864bc6cef8354692","observation_id":"3d92a750-e61d-4f56-8bc8-191e6652ad31","resolution":{"observed_at":"2026-08-06T11:15:34.105303Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T11:15:34.026962Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.026962Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:312e325416b264fc7319021b69403517b2a6ad59876d557d1aeccb29c6b2302f","observation_id":"ac7a5324-4274-4cab-8520-2661799740bd","resolution":{"observed_at":"2026-08-06T11:15:34.026962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T11:15:34.029186Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.029186Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:73f8c2dcc9b499b2e967002d4ef3acd7d50c8459d4157f0f5090a7750b21dd28","observation_id":"0328b448-115f-40cd-bbfc-6204c94d80f2","resolution":{"observed_at":"2026-08-06T11:15:34.029186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20586","last_updated":"2025-08-26T23:08:09Z","snapshot_observed_at":"2026-08-10T16:31:28.471977Z","submitted_at":"2025-02-27T23:01:31Z","title":"Training LLMs with MXFP4","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20586","snapshot_observed_at":"2026-08-06T11:15:34.031488Z","title":"Training llms with mxfp4,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.031488Z"},"links":{"cited_paper":"/paper/2502.20586","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:2197c9c118bcdc285ce9c72a36ed1b259a434932c8430c102f7e9d7877ba2445","observation_id":"ca415c67-07c8-4bb1-bf9b-d9649486e814","resolution":{"observed_at":"2026-08-06T11:15:34.031488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.409351Z","title":"Spatten: Efficient sparse attention architecture with cascade token and head pruning,","venue":null,"work_id":"acee3a0c-d6bd-41fc-8e1b-1e461075be54","year":2021},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.033634Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:7290c0180fa6a193cd98f667337e128e8b07d2069ae89baf56a452ced6cbb7bb","observation_id":"a5e8def4-b552-453b-a57f-78b0e69e68de","resolution":{"observed_at":"2026-08-06T11:15:34.411949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.035550Z","title":"Transformers: State- of-the-art natural language processing,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.035550Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:bb4532cee23994d6e90bf84ea1893091f96d20da4c06e743780f7a8c0bce2ca6","observation_id":"c2de2862-1679-441e-b993-7cfcf9e66440","resolution":{"observed_at":"2026-08-06T11:15:34.035550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.398637Z","title":"Block- wise mixed-precision quantization: Enabling high efficiency for practical reram-based dnn accelerators,","venue":null,"work_id":"3030df07-7f23-472a-9891-23418f4f365a","year":2024},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.038007Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:ef617a68fb1e13534b227c99789f3e01467ff010fd30187bf1bb4e58f09025b0","observation_id":"8dfb485f-b35d-4ac7-ba3e-55b33b8f6c72","resolution":{"observed_at":"2026-08-06T11:15:34.401129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.039849Z","title":"Smoothquant: Accurate and efficient post-training quantization for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.039849Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:e1f28fcd7c249ec4e4eea208764c5941dd84c91c061721710fc587e34b22f541","observation_id":"fce3dd4c-b901-4376-9ad9-194b8fe19afc","resolution":{"observed_at":"2026-08-06T11:15:34.039849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-10T16:18:23.994244Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-06T11:15:34.041839Z","title":"Hel- laswag: Can a machine really finish your sentence?","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.041839Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:6aa7e74f93fd012423cbb8ef21a21294a2e58ac8dd9f544b36124fb472f2d603","observation_id":"8ed5d561-1e23-4b49-94d1-8c349e8dd2e8","resolution":{"observed_at":"2026-08-06T11:15:34.041839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.385330Z","title":"Lq-nets: Learned quantization for highly accurate and compact deep neural networks,","venue":null,"work_id":"08720f0e-ff05-469c-b563-20fd146a3503","year":2018},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.044005Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:314fb47000dd7c38eff2a5b4a28de9e3d18d0e5095efc7b664e2f9fea97852fc","observation_id":"f0c0c966-a8ae-4717-b45d-67c7d0e6e38b","resolution":{"observed_at":"2026-08-06T11:15:34.387928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-06T11:15:34.045763Z","title":"Opt: Open pre-trained transformer language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.045763Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:875e2b59168ed4863fb2f17546bd7fb930a4415e9675999579ee014e90a90832","observation_id":"f4ae1c58-19aa-45ab-b601-7249c9c27193","resolution":{"observed_at":"2026-08-06T11:15:34.045763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:15:34.047943Z","title":"Atom: Low-bit quantization for efficient and accurate llm serving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.047943Z"},"links":{"citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:e8c10fb5b52117e03074e0cbf2754503a10b8375182ac5a3ed1457da60cb6d9c","observation_id":"08062e34-8710-45a4-b3cf-5cd7fd723fce","resolution":{"observed_at":"2026-08-06T11:15:34.047943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T07:42:40.315920Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":1,"verified_fuzzy":19},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2507.23035."}