{"as_of":"2026-08-14T11:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5a377470f223efead1e36fbde2efa886141a4be794596aa688292befd057224e","coverage":[{"denominator":121,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T12:19:43.247215Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.07578/citation-record","integrity":"/paper/2502.07578/integrity","json":"/paper/2502.07578/citation-record.json","paper":"/paper/2502.07578"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.861786Z","title":"URL: https://azure.microsoft.com/en-us/ pricing/calculator/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.861786Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:f693a6ec9ec13c341171650ee2949d65ffe0ad8d12ab549468f27d7987357025","observation_id":"07bac523-f739-4068-87a5-c1bcda05eaac","resolution":{"observed_at":"2026-08-08T12:19:42.861786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.866044Z","title":"Enabling cxl memory expansion for in-memory database management systems","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.866044Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:85619aab1535a2cba18bdb418fe4d5a3d1dc1c0b5cb6493101f9e4475847e136","observation_id":"f50db636-43f6-481c-b096-45b2a2d8b8c8","resolution":{"observed_at":"2026-08-08T12:19:42.866044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-08-08T12:19:42.869539Z","title":"Gqa: Training generalized multi- query transformer models from multi-head checkpoints, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.869539Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:e0a5297ce16f00b94b651d8965f36db1f6f996652cb0399c95240418c163a14d","observation_id":"5089bf48-f3a9-4e3d-91cb-1453f5c22089","resolution":{"observed_at":"2026-08-08T12:19:42.869539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.873549Z","title":"Introducing the next generation of claude","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.873549Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:6e2f3366afd82d9a35131fa7b040e24226a03a3d2b58fa5a198418ccd3af388d","observation_id":"a3d5d758-2180-4b31-b598-d9b0e46d418d","resolution":{"observed_at":"2026-08-08T12:19:42.873549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.877646Z","title":"Exploiting CXL-based memory for distributed deep learn- ing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.877646Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:431898222650af136c188a0c2322047021f0696910f49b4f63d2bccc3b3927bb","observation_id":"ea5c3df5-c2e5-413d-ab17-fb19b56d3d23","resolution":{"observed_at":"2026-08-08T12:19:42.877646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.881241Z","title":"Llama 2 70b: An mlperf inference benchmark for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.881241Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:84ed246e063e51c67a351c5a10b3ad7a5d430b92ed9a35aaafec8ac2d0826799","observation_id":"5a0cd7bb-5661-46a5-b1b2-fb361d8d7820","resolution":{"observed_at":"2026-08-08T12:19:42.881241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.884793Z","title":"Improving image generation with better captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.884793Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:a672324dca2634f0eb92064424a75ec8bbb47d326ed6236feccdca833f1742a2","observation_id":"a3965f40-faf1-48a8-8170-6704fd7edf22","resolution":{"observed_at":"2026-08-08T12:19:42.884793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.888201Z","title":"144-lane, 72-port, pci express gen 5.0 pex89144 express- fabric platform","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.888201Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:06c91ecf822635d279ce2d77c4ecb2e0a43be58005d70f071c36b6047160a06b","observation_id":"24294e30-8d96-4e91-bc5c-60cdcf8f0080","resolution":{"observed_at":"2026-08-08T12:19:42.888201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.891765Z","title":"The berkeley out-of-order machine (boom): An open-source industry- competitive, synthesizable, parameterized risc-v processor","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.891765Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:9ef176a2351ac6a30dfcbd7c5a74865d6d6b05f36e694006fd683c14dd06b981","observation_id":"7d94f444-8173-4e1f-9ad4-c70dc261920b","resolution":{"observed_at":"2026-08-08T12:19:42.891765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.896429Z","title":"Patterson, and Krste Asanović","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.896429Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:6f3b7f843b5bd692ed9551c88b0920d96562144afb6e3b130e3b77ad893e4309","observation_id":"5bbabc2f-30e6-4979-aaf5-7321ed902eef","resolution":{"observed_at":"2026-08-08T12:19:42.896429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.899955Z","title":"Eyeriss: An energy-efficient reconfigurable accelerator for deep convolutional neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.899955Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:d4c748ca5f79d23d074801ca1ae1d74c9d904cd908b1d9aafd2b2aa3021634ce","observation_id":"bbaeb890-7147-48e2-9b19-32d4dddaccfe","resolution":{"observed_at":"2026-08-08T12:19:42.899955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12307","last_updated":"2024-03-08T15:26:38Z","snapshot_observed_at":"2026-08-13T10:08:08.030837Z","submitted_at":"2023-09-21T17:59:11Z","title":"LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12307","snapshot_observed_at":"2026-08-08T12:19:42.903454Z","title":"Longlora: Efficient fine-tuning of long-context large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.903454Z"},"links":{"cited_paper":"/paper/2309.12307","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:895fe105d3549070167e7ee0237f5cf25966f7681384c06662ffc92b9253a208","observation_id":"5a3e52fd-7d4b-4141-b10d-809ffeee38ff","resolution":{"observed_at":"2026-08-08T12:19:42.903454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.907410Z","title":"The true processing in memory accelerator","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.907410Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:612b9b7072d96af951a3d17a4b9035b58598055124c6da387b0dbe78a3ab8c1a","observation_id":"2469b9de-ad81-44cc-9436-8113f685dad5","resolution":{"observed_at":"2026-08-08T12:19:42.907410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.910828Z","title":"To pim or not for emerging general purpose processing in ddr memory systems","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.910828Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:53e68792e21d9c5575862a928414e608ead922aa16024278db0d71add85b0ce8","observation_id":"004a9ef1-3dcb-4734-b9bd-d136be30c219","resolution":{"observed_at":"2026-08-08T12:19:42.910828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-08T12:19:42.917902Z","title":"BERT: pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.917902Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:02042cdd951773c53fc65360be5b125acd9133401c27b08e92bb105f9b8e2dea","observation_id":"338a6725-26d1-48f7-b93b-c2cf52df2949","resolution":{"observed_at":"2026-08-08T12:19:42.917902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.921715Z","title":"Dram spot price","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.921715Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:980c57984fa0e0cea86a0326d349c39ddb2cc68a2fcdbd7702564089b24d2706","observation_id":"cd1e20ff-666e-4342-a52f-208a3b487efe","resolution":{"observed_at":"2026-08-08T12:19:42.921715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T12:19:42.926165Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.926165Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:67f44c4f9b252a5a2bfa4e654e1b1cd1c8ee6d2cb1779bd0e7dc0af27b714df5","observation_id":"49a53810-bc51-4a1c-9f6b-e73e391f1e6e","resolution":{"observed_at":"2026-08-08T12:19:42.926165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.930080Z","title":"The inference cost of search disruption – large language model cost analysis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.930080Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:929ca2543a9460726da565f19acebf2a41c56d87c400114d1d9f87f83298bca5","observation_id":"67955ca7-fbde-4b9f-8eb0-223e80525b45","resolution":{"observed_at":"2026-08-08T12:19:42.930080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.934251Z","title":"Nvidia tesla a100 80gb gpu sxm4 deep learning com- puting graphics card oem","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.934251Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:2b4e5df3d9ffb5ce10e84bb5cf6c763dc697635632fb07a9e708e870e716c412","observation_id":"12ba10d4-ae69-4261-a872-0cc372b2d438","resolution":{"observed_at":"2026-08-08T12:19:42.934251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.938373Z","title":"Pci interface ic","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.938373Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:63ea7869d0dcab77cbb71310b6dda74a719db4e69bd1017076763ac414b0b93d","observation_id":"c3f77fda-f121-4c79-a0de-2993503f6b9d","resolution":{"observed_at":"2026-08-08T12:19:42.938373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.03118","last_updated":"2017-11-02T02:48:38Z","snapshot_observed_at":"2026-08-02T23:09:11.731136Z","submitted_at":"2017-02-10T10:04:30Z","title":"Sigmoid-Weighted Linear Units for Neural Network Function Approximation in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.03118","snapshot_observed_at":"2026-08-08T12:19:42.942471Z","title":"Sigmoid-weighted linear units for neural network function approximation in reinforcement learning, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.942471Z"},"links":{"cited_paper":"/paper/1702.03118","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:46e7d8139ef7a1fae4c0afb4ee143ff67d693667184f86d3463535c1654ef471","observation_id":"2f0894fd-ced2-40d0-91ef-bbda10643519","resolution":{"observed_at":"2026-08-08T12:19:42.942471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.946555Z","title":"Adaptable Butterfly Accelerator for Attention-based NNs via Hardware and Algorithm Co-design","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.946555Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:a70a0468031949bd6f00a29b5a527f40d179a1aa3d3cc9898e6cd94dc816d4a4","observation_id":"fde56906-0e9f-4ce9-a19b-78ad37b29a88","resolution":{"observed_at":"2026-08-08T12:19:42.946555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.950787Z","title":"NDA: Near-DRAM acceleration architecture lever- aging commodity DRAM devices and standard memory modules","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.950787Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:1ff1d7a86259148fdaaa8a805ea9f14ff2b04ed4981bbcfae7207aa2882b6292","observation_id":"40162986-cd5d-489c-9cb5-40d60ace121d","resolution":{"observed_at":"2026-08-08T12:19:42.950787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.954152Z","title":"Reinhardt, Adrian M","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.954152Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:ca400853739003563e11920714cfcb4d9ccfb0dd0784f5e6977cc2cf23cfd454","observation_id":"5c1f2059-3400-449b-b31b-ff9222b4fa4d","resolution":{"observed_at":"2026-08-08T12:19:42.954152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.961275Z","title":"Sparsep: Towards ef- ficient sparse matrix vector multiplication on real processing-in- memory architectures","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.961275Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:b368a07d107a150277a12a90ebf7263ebeaeb434bc6b3ee4df2dfaf8bed11f5a","observation_id":"6456e43a-4f47-40ce-ba0a-2873b1e4bee8","resolution":{"observed_at":"2026-08-08T12:19:42.961275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.964664Z","title":"Benchmarking a new paradigm: Experimental analysis and characterization of a real processing-in- memory system","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.964664Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:bd55b1274093a2d4f3ce759e42ff76e05312fc0b2866d58f3e7d4d2b3440bc45","observation_id":"77b8ec34-0861-4634-9898-0ae60995e6eb","resolution":{"observed_at":"2026-08-08T12:19:42.964664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.968712Z","title":"Evaluating machine learningworkloads on memory-centric comput- ing systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.968712Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:9fa84c0fb9f6c436db08077f59170ac5364814df01aa5b9cf61d64dbbc23abb5","observation_id":"931f5695-aaf7-4f1c-9352-0a50f9f63405","resolution":{"observed_at":"2026-08-08T12:19:42.968712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.972030Z","title":"Our next-generation model: Gemini 1.5","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.972030Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:285a4401e36cc5edf1a3a44dc6bfc8dd520ff2ca2e3dbbdc52e5637c29ae2b51","observation_id":"c6cc619e-5bb2-46e2-a359-a533ca66c343","resolution":{"observed_at":"2026-08-08T12:19:42.972030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.975332Z","title":"Memory pooling with cxl.IEEE Micro, 43(2):48– 57, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.975332Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:c80f6f402155273cdbf4be8a588f664aa8acbc1c26af2ae96da2752ebbf9ed8b","observation_id":"834a3a4f-a801-4228-9c53-1d452bad5f9f","resolution":{"observed_at":"2026-08-08T12:19:42.975332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.978839Z","title":"Direct access, High-Performance memory disaggregation with DirectCXL","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.978839Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:08f18f967cfb4325262992a46f63cc534bc0267cc4b98f4472fd234f81eca429","observation_id":"49574b5b-b973-451a-8eed-66df7d31407a","resolution":{"observed_at":"2026-08-08T12:19:42.978839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.982214Z","title":"OliVe: Acceler- ating Large Language Models via Hardware-friendly Outlier-Victim Pair Quantization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.982214Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:91c32c0639865ca2840f958d2741a861c96598a5bdf4e09a29752bd8fdaeac7f","observation_id":"f5295c49-69b5-4e67-8994-0e33a8f01a05","resolution":{"observed_at":"2026-08-08T12:19:42.982214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-08T12:19:42.985722Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforce- ment learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.985722Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:7584373cc4c4664c8f5b366fcdff58cc1a72bf4f1ecc938ba97ee5b44901eb6c","observation_id":"61eaf1de-bd24-4108-903c-c4c1a42c4044","resolution":{"observed_at":"2026-08-08T12:19:42.985722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.989518Z","title":"ELSA: Hardware-software co-design for efficient, lightweight self-attention mechanism in neural networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.989518Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:cf73e5e7e71432a39ad0901e119a39c9c02595ab7b2ef65a0db2edd5e2d08df0","observation_id":"9b69936e-63a4-47c0-955d-64219e5c4490","resolution":{"observed_at":"2026-08-08T12:19:42.989518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.992996Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.992996Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:3f52682f31df097d4fa83badf369d9f776210b0a9260340c0f2a2fb865bf8391","observation_id":"5e296e87-2f2c-4d9a-b59c-ac1b3e695651","resolution":{"observed_at":"2026-08-08T12:19:42.992996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-08-13T19:48:28.322536Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-08T12:19:42.996285Z","title":"Gaussian error linear units (gelus)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.996285Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:33da3736ffcdd53733535a15908c12c94c9a1e959afd46db48ac23f2111e87d3","observation_id":"55134ec4-639a-426d-8520-975c003e047c","resolution":{"observed_at":"2026-08-08T12:19:42.996285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.999831Z","title":"Neupims: Npu-pim heterogeneous acceleration for batched llm inferencing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.999831Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:a84af0fb4e76e1b0d4fee70eafeb118d2cf6cd71a8efdc5526c11d59774cb6f8","observation_id":"cb395ee5-4e1b-416a-ae1e-4824d597c81c","resolution":{"observed_at":"2026-08-08T12:19:42.999831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.007401Z","title":"Le, Yonghui Wu, and Zhifeng Chen","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.007401Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:4c67de74b238b4f57bdec8d146614764322e8ff3e28ce9b12e181dc4489c95e6","observation_id":"63c96630-b1d1-448b-b1fc-ed12aa84ec4d","resolution":{"observed_at":"2026-08-08T12:19:43.007401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.011573Z","title":"BEACON: Scalable Near-Data-Processing Accelerators for Genome Analysis near Memory Pool with the CXL Support","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.011573Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:d30117a73e5a3a4e589f6148e2224f7369b618b978f543eb382e3aebd5edda65","observation_id":"6ffc5613-87bf-401f-8af7-621eb91e81f2","resolution":{"observed_at":"2026-08-08T12:19:43.011573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.015085Z","title":"Floatpim: In-memory acceleration of deep neural network training with high precision","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.015085Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:d8b0f3cafc96656282c325acccf0517d4e235505f5c7cdae91332e2a7fb19f18","observation_id":"ba3a06f7-092e-4df1-a37c-510a3da0fa64","resolution":{"observed_at":"2026-08-08T12:19:43.015085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.018239Z","title":"Ultra-efficient processing in-memory for data intensive applications","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.018239Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:2ac3042027aab4404050cfdc66457ed81dd7dfbfdfa47c87a808cd718a921449","observation_id":"9ba074ee-9d04-4044-a038-a29e28cb3de0","resolution":{"observed_at":"2026-08-08T12:19:43.018239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.021491Z","title":"Intel xeon gold 6430 processor, 60m cache, 2.10 ghz","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.021491Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:0c0c5de60e33dc336ff5f366f2ffbc8832d9ea34a97edccc33659691919b1da4","observation_id":"fed0dce8-a0f9-46db-bfbe-c59958960241","resolution":{"observed_at":"2026-08-08T12:19:43.021491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.025589Z","title":"Intel ® xeon® gold 6430 processor","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.025589Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:5868709ba0af47b53c63bdbad0cb02f2e4b8d48aa0e8c96e3f2a8b02edad1849","observation_id":"bfa1399a-05e0-4d73-a5a6-e7ba13adfdf0","resolution":{"observed_at":"2026-08-08T12:19:43.025589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.029008Z","title":"CXL-ANNS: Software- Hardware Collaborative Memory Disaggregation and Computation for Billion-Scale Approximate Nearest Neighbor Search","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.029008Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:182d5d95d12e902aa184354747b7b0eb305fd1eaecd8e03c738ed22a0fb2b115","observation_id":"3d974faa-ce32-4c60-9c7f-19365e6705cd","resolution":{"observed_at":"2026-08-08T12:19:43.029008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.032314Z","title":"Tpu v4: An optically reconfigurable supercomputer for machine learning with hardware support for embeddings","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.032314Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:6eb03436bf4ac67ea4bf369dfa9864a793584a13e300bc1957332c089b0711d2","observation_id":"bf1c202c-5700-43bd-b906-d8d3953b23e6","resolution":{"observed_at":"2026-08-08T12:19:43.032314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.035525Z","title":"Noise-resilient DNN: Tolerating noise in PCM- based AI accelerators via noise-aware training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.035525Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:ce36ee9e735579dce414934d01ba9740019d23e7f9010b2dc08792a02c4e0f23","observation_id":"f3183397-8d8e-4962-b7fd-85ba7ed408bb","resolution":{"observed_at":"2026-08-08T12:19:43.035525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.039355Z","title":"ChatGPT for good? On opportunities and challenges of large language models for education","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.039355Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:1706c60b18692a2982e7008740d102dd414415cf09be33b234256939ac0048a8","observation_id":"551d1872-b606-4835-927f-e7255e0853e1","resolution":{"observed_at":"2026-08-08T12:19:43.039355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.043715Z","title":"Rec- nmp: Accelerating personalized recommendation with near-memory processing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.043715Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:c3acca1e2b4644aa8a876c4c8089672a58775f4eb33decd407ae38f938456c7b","observation_id":"fc0b1791-a46a-4a6c-bef5-518b86cd102e","resolution":{"observed_at":"2026-08-08T12:19:43.043715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.047402Z","title":"Moonwalk: Nre optimization in asic clouds.ACM SIGARCH Computer Architecture News, 45(1):511–526, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.047402Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:57027c31a4194b4c9bdb192a045cd44fc0bc16969638d136ffaa48227d0fcfcf","observation_id":"40984173-3fef-493d-8435-905a989496c9","resolution":{"observed_at":"2026-08-08T12:19:43.047402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.051215Z","title":"Aquabolt-XL HBM2-PIM, LPDDR5-PIM with in-memory processing, and AXDIMM with accel- eration buffer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.051215Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:90015156070933adbb4d3f45cc8375bf7de604dd20b2da3ed72509c167367607","observation_id":"21964e30-ba5f-42c4-93fe-95844210fa51","resolution":{"observed_at":"2026-08-08T12:19:43.051215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.420068Z","title":"Samsung PIM/PNM for Transfmer Based AI: Energy Efficiency on PIM/PNM Cluster","venue":null,"work_id":"03248578-ccdc-42fa-8e4d-d2b028fb2fda","year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.055256Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:d834e7f72ef5f498e9b7abc664084c7a13ef24703721ea0418bfa04e9a877784","observation_id":"815bf70f-471f-4ee4-9d71-5072dcb57c42","resolution":{"observed_at":"2026-08-08T12:19:44.424550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.059497Z","title":"A 1ynm 1.25v 8gb 16gb/s/pin gddr6-based accelerator-in-memory supporting 1tflops mac operation and various activation functions for deep learning application","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.059497Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:02dea6e6022a43acbac16ff90a844fc2735b207d1934e36b29da892a4f2bbc70","observation_id":"24dbc041-3b61-4467-884a-3dfc5ade2e11","resolution":{"observed_at":"2026-08-08T12:19:43.059497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.406545Z","title":"Maeri: Enabling flexible dataflow mapping over dnn accelerators via recon- figurable interconnects","venue":null,"work_id":"3de9cc56-f502-4f11-92fc-9ad3cbd5b614","year":2018},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.063790Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:01f5beefcab20f8532d232617087c52d7183b4fb0ca93018cc767d3d972ff550","observation_id":"b6cef06e-7a03-471a-b491-2f78bf7b2609","resolution":{"observed_at":"2026-08-08T12:19:44.411377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.067968Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.067968Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:90f51fb204f451ec1deff26789dadaf9039cfbb414d5a443e41f2d413ded1330","observation_id":"6588b9e2-114f-418f-a03a-f1a17dc44c75","resolution":{"observed_at":"2026-08-08T12:19:43.067968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.072246Z","title":"Memory-centric computing with sk hynix’s domain-specific memory","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.072246Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:cee02188214522583b9bf39d664f3b2ca2e1d81bf811ec140ac007890b8a60a6","observation_id":"0be80827-8f78-46d0-aab6-14544a8d6650","resolution":{"observed_at":"2026-08-08T12:19:43.072246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.387400Z","title":"System architecture and software stack for GDDR6-AiM","venue":null,"work_id":"194f92d5-4cb9-44c1-8e0f-de31ddb31f68","year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.076737Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:f6ff24d52ffd452069b8e6b1684b23738aff6c4b63aec4853afcfccc726d999b","observation_id":"c7b25c34-da8e-45b6-a33f-722a70341f7f","resolution":{"observed_at":"2026-08-08T12:19:44.391031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.376563Z","title":"25.4 a 20nm 6gb function-in-memory DRAM, based on HBM2 with a 1.2 tflops pro- grammable computing unit using bank-level parallelism, for machine learning applications","venue":null,"work_id":"86f4dc03-2b08-4d13-9fb1-06de7846a417","year":2021},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.080673Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:a60c966fc266c70f139c04ebb3b138f8943a523e1bc1af8651492c75f8fb92d8","observation_id":"7b24437a-9736-4834-b18c-7bb0c0f435ba","resolution":{"observed_at":"2026-08-08T12:19:44.380426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.365325Z","title":"Improving in-memory database operations with acceleration DIMM (AxDIMM)","venue":null,"work_id":"bf57d69c-3285-45ef-ac87-cac4ba34edfe","year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.084956Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:92393159f309f94e6982c5beeb804e1f8e694e654d78cd9c7267b93e5d60e5fa","observation_id":"66bdc8f1-1e91-4704-bee7-d804f371433f","resolution":{"observed_at":"2026-08-08T12:19:44.369207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.353973Z","title":"Using machine learning to increase yield and lower packaging costs","venue":null,"work_id":"961b37cb-2c8e-4ee3-a048-7e69ee58f116","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.088957Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:eddf253656a5418a76aa860846877e762b6ddce3725a04435d95ec84277c0d9b","observation_id":"bc0b94e1-27db-470f-a9be-167adc88e9e6","resolution":{"observed_at":"2026-08-08T12:19:44.357587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.343761Z","title":"A 1ynm 1.25 v 8gb, 16gb/s/pin gddr6-based accelerator-in-memory supporting 1tflops mac operation and various activation functions for deep-learning applications","venue":null,"work_id":"0698653d-2bb8-4e6b-a1b2-93468e9d8eba","year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.093213Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:b982f638249a650521986871de6beba823079cc6c3de034e1c8fd3d20ec89961","observation_id":"5d1065ab-8c94-415c-9c2c-93facde77733","resolution":{"observed_at":"2026-08-08T12:19:44.347503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.332594Z","title":"Berger, Lisa Hsu, Daniel Ernst, Pantea Zardoshti, Stanko Novakovic, Monish Shah, Samir Ra- jadnya, Scott Lee, Ishwar Agarwal, Mark D","venue":null,"work_id":"f3c0a3b5-7fa9-42d7-8c7d-22b0bb51da85","year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.097580Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:cdc944c254bdb8ee4644aa3e641e101bea2d428f568b4ee3d16aaedb0b756a48","observation_id":"06c69c93-84af-4188-b7d6-b4ebf002e139","resolution":{"observed_at":"2026-08-08T12:19:44.336520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.322418Z","title":"Accelerating distributed reinforcement learning with in-switch computing","venue":null,"work_id":"c943cc6a-1f01-468d-af8e-340130b46188","year":2019},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.101725Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:151c09c2ead3d63faaa9aa10adca25da7fd3dc70482271c13056d23ee0810d5a","observation_id":"4cdfb794-01a7-46ab-a526-cb5ae6f9a145","resolution":{"observed_at":"2026-08-08T12:19:44.326047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.312264Z","title":"Specification","venue":null,"work_id":"1e31d436-b09d-4f7d-83f9-282412515878","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.105664Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:2c302b61c523f6a766272739c9c62ef61f8ab43e67c8654652bd4d3d243dbf68","observation_id":"8ed1efdb-7d91-4d21-8099-e68bb427a939","resolution":{"observed_at":"2026-08-08T12:19:44.315839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-08T12:19:43.109950Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.109950Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:600274888de67b2bcd5421f5b3556b77bddf8e5073138bd493f8482979a988aa","observation_id":"7f709682-02b2-49d6-829d-af86e7374b5a","resolution":{"observed_at":"2026-08-08T12:19:43.109950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.301795Z","title":"Enmc: Extreme near-memory classification via approximate screening","venue":null,"work_id":"5221e3e5-50a8-4c7f-b93b-cc8522d9d9d5","year":2021},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.113850Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:2c374b1355d24624c9ab4c83df2e8b6c348937461e954541bf79a3e8079f20cf","observation_id":"510e802c-84e8-47b2-af67-c7f69a80ffe1","resolution":{"observed_at":"2026-08-08T12:19:44.305602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.291291Z","title":"Sanger: A co-design framework for enabling sparse attention using reconfigurable architecture","venue":null,"work_id":"fdfd2dac-3a0c-45d7-b19a-40201026b342","year":2021},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.118085Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:e918582f9e7b14f297efbb4a0cfcf288f6fc42083058774da838e81a2b73c516","observation_id":"9ccfcc69-ef8b-44b3-a38d-05032c7029c6","resolution":{"observed_at":"2026-08-08T12:19:44.294964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11030","last_updated":"2023-11-29T00:21:13Z","snapshot_observed_at":"2026-08-13T10:30:10.054164Z","submitted_at":"2023-08-21T20:39:10Z","title":"Ramulator 2.0: A Modern, Modular, and Extensible DRAM Simulator","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11030","snapshot_observed_at":"2026-08-08T12:19:43.122136Z","title":"Ramulator 2.0: A Modern, Modular, and Extensible DRAM Simulator","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.122136Z"},"links":{"cited_paper":"/paper/2308.11030","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:ffe21daeadb91ff1522d991d4aa3bb42dcd2abc28cf6efc7e5fdbad6eb23ceb4","observation_id":"0ae30fee-06ff-434c-8ca7-5fb36673ebfc","resolution":{"observed_at":"2026-08-08T12:19:43.122136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.280085Z","title":"A Binary-activation, Multi-level Weight RNN and Training Algorithm for ADC-/DAC- free and Noise-resilient Processing-in-memory Inference with eNVM","venue":null,"work_id":"42152be8-f884-4332-b0d5-13b7c3d6e014","year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.126343Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:5c6a5b1f458fe98a9e8102dd3b730923c32fd3ed421d2e07086b67a19dee19ea","observation_id":"bac7644a-2243-4259-a206-b048edc8780a","resolution":{"observed_at":"2026-08-08T12:19:44.283985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.270166Z","title":"Dram power calculator","venue":null,"work_id":"7d905f38-d1d0-4f4f-b873-8e767c96595a","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.129668Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:1da030f6bc8040cba5bfecdae0d8714374e641bcbdb0ce32a4465df64ddf8d47","observation_id":"91daf12f-993f-4c47-a980-e9d882c50483","resolution":{"observed_at":"2026-08-08T12:19:44.273545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.259704Z","title":"Nvidia shipped 3.76m data center gpus in 2023","venue":null,"work_id":"2f9716f0-2ffe-4bfa-9c2b-279ef1d6495d","year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.133028Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:0a60c66953a0f17d5ae8d5373c13950366d37ce2b20e6d14f0977135467a9629","observation_id":"b421ff6f-4c59-477b-b23b-21d96fadea73","resolution":{"observed_at":"2026-08-08T12:19:44.263356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.249773Z","title":"Supply chain aware computer architecture","venue":null,"work_id":"c88d87dc-356b-4c65-8706-679f856eb573","year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.136219Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:9b9edd86d00d61cc56e4dc4a594b873165caaefcc688399729280a20a76779ed","observation_id":"ab8cb036-44dc-4216-915c-da2638c00132","resolution":{"observed_at":"2026-08-08T12:19:44.253293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.239608Z","title":"184QPS/W 64Mb/mm 2 3D logic-to-DRAM hybrid bonding with process-near-memory engine for recommendation system","venue":null,"work_id":"a78e2e39-1a08-4a6c-9f1a-f025dfb53377","year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.139776Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:23c0613f5c3fc753b22134dde4249d3723bbdb321b020cde482fd29bd4f7af41","observation_id":"7d85537c-4844-4d37-9329-0f38af56f576","resolution":{"observed_at":"2026-08-08T12:19:44.243312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.229148Z","title":"Introduction to the nvidia dgx a100 system","venue":null,"work_id":"c1c814d3-2473-4ab1-8c2d-af39a38ad125","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.143328Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:f8e1d753a43bebe7123309f3e2878d3aebfcae745b29c0d4472080cdd1fc77fe","observation_id":"ff55d8ee-85ff-4168-86b3-cdfc2e145b2e","resolution":{"observed_at":"2026-08-08T12:19:44.232936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.219169Z","title":"Nvidia a100 tensor core gpu","venue":null,"work_id":"e606923f-3ed6-4a88-96f5-f5cc20493827","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.146694Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:ae69bd10a16af703232e6bcf665c759fd4ddeaa658d3b9c96d9236b7737c888f","observation_id":"87ffbc70-e3a9-4f62-a1c7-08606df975ee","resolution":{"observed_at":"2026-08-08T12:19:44.222631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.208870Z","title":"Nvidia hgx a100, the most powerful end-to-end ai supercom- puting platform","venue":null,"work_id":"5432199d-0970-4136-aa1e-05295b48b3e4","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.150077Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:4b1b0136f3db1e8d0da908cd9aef920265a733d76501600afa3657d708bf86c0","observation_id":"b9db1fba-f9ff-41f1-839c-6a6dfc0ed566","resolution":{"observed_at":"2026-08-08T12:19:44.212585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.198763Z","title":"Nvlink and nvlink switch","venue":null,"work_id":"4c232a2a-3204-4dc9-a635-4d7d852bd6e6","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.153989Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:9289957eca5ad1341c9fda13d3a2c370e9f344563520d55190b0206ab62bd3b3","observation_id":"4f6571af-9e27-4194-9641-a9036d6ecbba","resolution":{"observed_at":"2026-08-08T12:19:44.202214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.188541Z","title":null,"venue":null,"work_id":"a06f95dd-79d9-49c6-bc5e-2d5951ccde5e","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.157526Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:e42197aa72124fdf2694c23db28c5829d6c820350dc31dc47549b303bca39abe","observation_id":"3cb0cb57-9174-4a9d-8d7c-0057f438580d","resolution":{"observed_at":"2026-08-08T12:19:44.191897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.177500Z","title":"Fine- grained dram: Energy-efficient dram for extreme bandwidth systems","venue":null,"work_id":"46de0665-3ffe-4939-94e3-ba9ba49a5e29","year":2017},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.160924Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:068ff61b58c1fb9b37051656c37711f9ef02724edc34bc7df064336cab241ca5","observation_id":"48f7f33b-48ef-4d04-9e6f-567b0376ba51","resolution":{"observed_at":"2026-08-08T12:19:44.181932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.167830Z","title":"Bureau of Labor Statistics","venue":null,"work_id":"7ee54a43-15bb-44fb-b0b7-01d074676286","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.164318Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:1ddba0a440fdc47d49bcd6985743a075fdc17a42c82dc83a3f89d6c72f4c858d","observation_id":"001a95ce-8a7c-4781-a9a6-d1e1842e31df","resolution":{"observed_at":"2026-08-08T12:19:44.171164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.158073Z","title":"Accelerating neural network inference with processing-in-dram: From the edge to the cloud","venue":null,"work_id":"ab1fb5c9-7c29-4625-9fc5-9b04928f7b72","year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.168553Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:3c11126ac806eba9eff076bf3c227ece7e69b926e2e5f07941cd7f20870678e4","observation_id":"93dc2701-7455-4c73-a6e6-33f54ddaa771","resolution":{"observed_at":"2026-08-08T12:19:44.161590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.147722Z","title":"Gpt-4 turbo and gpt-4","venue":null,"work_id":"62185b77-6e5f-4e61-8d20-55af88d07b2f","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.172611Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:774a05251d588ae491d110c46161e8434ed2d6eafc0128b821849cf798e00f1c","observation_id":"53c05752-51aa-45d7-a70a-58eac2fb0983","resolution":{"observed_at":"2026-08-08T12:19:44.151325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.137420Z","title":"Learning to reason with llms","venue":null,"work_id":"45d06caf-ca82-4d13-923e-968a52d85fe1","year":2025},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.176883Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:c485dcb595026c6a4f3f3a577b1f373c4bbcf0f8e633704eb6aa0088a7d91df6","observation_id":"89e01c35-16d1-4ced-bc9e-a20aeb8f2d32","resolution":{"observed_at":"2026-08-08T12:19:44.140848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.126493Z","title":"Video generation models as world simulators","venue":null,"work_id":"18dc3504-ebe9-4b7b-ac18-1063c6d8577e","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.180173Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:aed27e5392d8db2fc48ebdf9f2295ef61e3af227d22807dadfa8390d66c0394b","observation_id":"72d9eac6-99da-4454-9711-51cc0a1679c7","resolution":{"observed_at":"2026-08-08T12:19:44.130360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T12:19:43.183524Z","title":"GPT-4 Technical Report, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.183524Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:55b72c29e4da387a442e30dab0fb2039382b24cebbfba3604ada6c232bd1d1b6","observation_id":"05f5e22d-b5ed-44e4-91e8-f04aa921dd0d","resolution":{"observed_at":"2026-08-08T12:19:43.183524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.111892Z","title":"Cost and yield analysis of multi-die packaging using 2.5 d technology compared to fan-out wafer level packaging","venue":null,"work_id":"27c35a3b-6dbb-4aed-bcec-8af7d0f7f40a","year":2014},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.186916Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:ff1493976365dfb769ed9592e9e216f757099e410915faec25b4ce74ae4312ec","observation_id":"b83c9968-c212-40fa-9f43-80d845986aac","resolution":{"observed_at":"2026-08-08T12:19:44.116094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.100190Z","title":"Attacc! unleashing the power of pim for batched transformer-based generative model inference","venue":null,"work_id":"873f77c2-63d7-48fe-9fae-7d272f9c3eb9","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.190248Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:dbf0e06f0b1fd340bf85a11f1e6ecf4cdb8a432505b21b8b95207d587a0d586d","observation_id":"1d76f3a5-652f-412f-a3fa-fa8c10785fb6","resolution":{"observed_at":"2026-08-08T12:19:44.104257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.088702Z","title":"Trim: Enhancing processor-memory interfaces with scalable tensor reduction in memory","venue":null,"work_id":"2afd715b-bf0d-4c39-92ac-52b071389483","year":2021},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.197770Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:60472841acdfabc12e49b88357acb326491e977033ce6a0cb4ac0e04417fa2b1","observation_id":"49de6f65-d730-407d-8c97-2d2b9afe42ae","resolution":{"observed_at":"2026-08-08T12:19:44.092592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.077402Z","title":"An LPDDR-based CXL-PNM Platform for TCO-efficient Inference of Transformer-based Large Language Models","venue":null,"work_id":"512fc176-ebdc-43d4-bd34-857eae34c383","year":2024},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.201368Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:5316e5c5a0669769d83a2ab0798e6f11f98a6149adcfd406a25eae7ba7af1d06","observation_id":"a1d117e2-4a53-43a7-8f1d-f5aca6135e4e","resolution":{"observed_at":"2026-08-08T12:19:44.081069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.193719Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.193719Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:38f25aa69b11b7197872df14ceafe6890695f5466de16e86423fd8dddba59423","observation_id":"c2b6d119-1ac8-4b0c-8f60-3eb64c6beb38","resolution":{"observed_at":"2026-08-08T12:19:43.193719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.054300Z","title":"Splitwise: Efficient gen- erative llm inference using phase splitting","venue":null,"work_id":"6b70dbe5-df58-431e-b0c9-a6ea75cb9845","year":2024},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.208695Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:76e10bfc95e006e7e138b98e3bd94ea4b553f68a9f80b75a685f1467e12e5a8f","observation_id":"5b2912e3-6b3b-4e5b-ba80-6981b4c294a7","resolution":{"observed_at":"2026-08-08T12:19:44.059017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-14T11:08:32.950294Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-08T12:19:43.212984Z","title":"Movie gen: A cast of media foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.212984Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:9a53079ede78fecb5ab231d8f3f1397c8c9d7ef740a61169627cf4f1f72bf63e","observation_id":"b30cd212-45ff-4832-aeff-ec2c75b2361f","resolution":{"observed_at":"2026-08-08T12:19:43.212984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.066830Z","title":"Nvidia ada lovelace leaked specifications, die sizes, architecture, cost, and performance analysis","venue":null,"work_id":"c2da41ab-3b6f-4b1c-9389-f8703a63f6a6","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.204959Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:ac741f7a2c0d55bc4bce49a6cdf9d564aad411d8ffc5621a9642b0e188ecd413","observation_id":"cb0aafde-3aa6-426a-ac18-5890ceeaef73","resolution":{"observed_at":"2026-08-08T12:19:44.070811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.043079Z","title":"FACT: FFN- Attention Co-optimized Transformer Architecture with Eager Cor- relation Prediction","venue":null,"work_id":"8b4377a0-18b0-45c8-b0c2-c8f14fba233c","year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.221118Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:16f9c93b6c8a4c9377ec11706dd9f9d1eeac6f6c503f05660575c2b03932cb91","observation_id":"50869f67-984a-48bc-a6f2-53098521ce11","resolution":{"observed_at":"2026-08-08T12:19:44.046764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.032697Z","title":"Dota: detect and omit weak attentions for scalable transformer acceleration","venue":null,"work_id":"ac906625-b17d-4ca9-90ff-cebf65bad881","year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.225224Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:2c01487ee46bbebd6284aa480ac26a958a13e5e58458d1a65986350a8d6a27c3","observation_id":"7770edb4-b003-40ce-8c5b-e8e21091736f","resolution":{"observed_at":"2026-08-08T12:19:44.036444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.12409","last_updated":"2022-04-22T18:20:48Z","snapshot_observed_at":"2026-08-07T11:26:24.970964Z","submitted_at":"2021-08-27T17:35:06Z","title":"Train Short, Test Long: Attention with Linear Biases Enables Input Length Extrapolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.12409","snapshot_observed_at":"2026-08-08T12:19:43.216975Z","title":"Train short, test long: Attention with linear biases enables input length extrapolation.arXiv preprint arXiv:2108.12409, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.216975Z"},"links":{"cited_paper":"/paper/2108.12409","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:9ad05097ea0959dc4be82f0a8b7e0165fbda6ab871e8c83039bf5f4ac479026b","observation_id":"31adadca-0d46-4a13-9f5d-f7a7364b8f78","resolution":{"observed_at":"2026-08-08T12:19:43.216975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.021802Z","title":"Impala: Algorithm/architecture co-design for in- memory multi-stride pattern matching","venue":null,"work_id":"8fa7f3d9-ccb1-41be-908e-0e99a6b9cbe9","year":2020},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.233212Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:9ef8bd6bf1d587e46ad8b7a536d7b1eda19fcb37f76552804102f5ba892987f6","observation_id":"a8ad555e-ed1a-4fa2-9fc5-6b722b428f21","resolution":{"observed_at":"2026-08-08T12:19:44.025911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"lcsc/2204251","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.529496Z","title":"8gb gddr6 sgram c-die","venue":null,"work_id":"031830c2-82ba-4536-8094-8e8fbd67acea","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.236583Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:b4389bafe231ab5505f2236b2710ad03e903e076c98353d6f92b4c811a6afdc5","observation_id":"52e7404c-5666-46c4-bf2d-99a4b3108973","resolution":{"observed_at":"2026-08-08T12:19:43.535628Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.05941","last_updated":"2017-10-27T17:45:21Z","snapshot_observed_at":"2026-08-08T18:23:31.977872Z","submitted_at":"2017-10-16T18:05:45Z","title":"Searching for Activation Functions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.05941","snapshot_observed_at":"2026-08-08T12:19:43.229683Z","title":"Searching for activation functions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.229683Z"},"links":{"cited_paper":"/paper/1710.05941","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:efd17d738be8b7e117a8df29938d9ac43510dab12165ba38f1ba2be3acff5bad","observation_id":"347e29e6-146d-4f10-8c3c-f9e18db03e1d","resolution":{"observed_at":"2026-08-08T12:19:43.229683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-08T12:19:43.243256Z","title":"Glu variants improve transformer","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.243256Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:aaa55b3da2f3899af5544ec00c23a2e043408d5db175cb68284a7273d78d67ca","observation_id":"36b826bd-1753-4dde-8de6-b8fb57a89e45","resolution":{"observed_at":"2026-08-08T12:19:43.243256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-08-12T10:50:46.357243Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-08T12:19:43.247215Z","title":"Megatron-lm: Training multi- billion parameter language models using model parallelism","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.247215Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:057f71e00bb0b6e43d0a5340b47dd698d4c2de19bf072b738ce0e03632678946","observation_id":"1106256b-df8e-4e41-a921-c63c4186a17a","resolution":{"observed_at":"2026-08-08T12:19:43.247215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.011054Z","title":"Generative ai winds in memory semiconduc- tors, total demand for server drams is declining","venue":null,"work_id":"f09d2340-a54a-4be2-aff7-bf503c53234d","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.239755Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:419081244eb4ce18cdb78871165eb6cd1d9fa3f5b6a663eba0fd9ddfa9dc5aa8","observation_id":"7992e68b-9baf-43c4-87c3-91a2b39d4c87","resolution":{"observed_at":"2026-08-08T12:19:44.015080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","latest_version":3,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-13T04:11:45.770763Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":62,"verified_exact":1,"verified_fuzzy":37},"total_outbound_references":121},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 100 of 121 outbound references and 0 inbound Pith citation observations for arXiv:2502.07578."}