{"as_of":"2026-08-10T05:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f99de9305880f173c73706aa44b178d20e3f0aa7af229554170585b98d9a6f5d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:57:52.561193Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":9,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-08-07T04:57:52.561193Z","title":"Memory is all you need: An overview of compute-in- memory architectures for accelerating large language model inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09275","last_updated":"2025-06-10T22:25:29Z","snapshot_observed_at":"2026-08-09T23:54:14.495220Z","submitted_at":"2025-06-10T22:25:29Z","title":"A Survey of End-to-End Modeling for Distributed DNN Training: Workloads, Simulators, and TCO","version":1},"reference_index":127,"source":"pdf_text","source_observed_at":"2026-08-07T04:57:52.561193Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2506.09275"},"observation_digest":"sha256:19e4d3b3e0ac147cce9f765c4fc8f21e41ac253237cb182f18466ab22e93615e","observation_id":"d719e35a-261d-4984-b3e4-1074b5865fb9","resolution":{"observed_at":"2026-08-07T04:57:52.561193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-08-06T18:24:53.489848Z","title":"Wolters, X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08567","last_updated":"2025-08-07T11:18:14Z","snapshot_observed_at":"2026-08-09T17:00:22.878553Z","submitted_at":"2025-07-11T13:11:11Z","title":"AbbIE: Autoregressive Block-Based Iterative Encoder for Efficient Sequence Modeling","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T18:24:53.489848Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2507.08567"},"observation_digest":"sha256:ebe2b6fe85c67f8b44b8e1e204e2105a0a74b635d4190a4bac49655342284e88","observation_id":"9064938b-af1a-41b0-9766-ae704dcf6a9f","resolution":{"observed_at":"2026-08-06T18:24:53.489848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-08-06T14:59:21.220570Z","title":"arXiv:2406.08413 [cs.AR] https://arxiv.org/abs/2406.08413 Conference acronym ’XX, June 03–05, 2018, Woodstock, NY Trovato et al","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.220570Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:042af4dd89f6e620504d2bfbd6d210492aef2345e6e74894787b53fd43b4918e","observation_id":"313ba47d-2924-4ce0-8580-18c49df2de96","resolution":{"observed_at":"2026-08-06T14:59:21.220570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":"2406.08413","doi":"10.48550/arxiv.2406.08413","metadata_source":"pith","pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory is all you need: An overview of compute- in-memory architectures for accelerating large language model inference.arXiv preprint arXiv:2406.08413","venue":"cs.AR","work_id":"c0b3a041-7a1b-45ca-8530-dd2ee8602a04","year":2024},"citing_paper":{"arxiv_id":"2510.08055","last_updated":"2026-04-16T12:39:23Z","snapshot_observed_at":"2026-08-07T14:10:12.842070Z","submitted_at":"2025-10-09T10:41:35Z","title":"From Tokens to Layers: Redefining Stall-Free Scheduling for MoE Serving with Layered Prefill","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T08:47:29.759674Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2510.08055"},"observation_digest":"sha256:5b4dc599ff42bceef3cb70cf84d99b4e6464cdcb9207b062d9f9299eafd72157","observation_id":"fdf80982-8ef3-437a-85b8-8eca0a9fb394","resolution":{"observed_at":"2026-05-18T08:51:08.930601Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":"2406.08413","doi":"10.48550/arxiv.2406.08413","metadata_source":"pith","pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory is all you need: An overview of compute- in-memory architectures for accelerating large language model inference.arXiv preprint arXiv:2406.08413","venue":"cs.AR","work_id":"c0b3a041-7a1b-45ca-8530-dd2ee8602a04","year":2024},"citing_paper":{"arxiv_id":"2604.08637","last_updated":"2026-04-09T17:09:07Z","snapshot_observed_at":"2026-08-09T08:00:17.406731Z","submitted_at":"2026-04-09T17:09:07Z","title":"Increased endurance of nonvolatile photonics enabled by nanostructured phase-change materials","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T17:24:15.164171Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2604.08637"},"observation_digest":"sha256:461c8054ca5bc5237bf7d4a5988ec968e6b6ae72bcb1252d65354e7a4c95152f","observation_id":"004f0709-0cbf-42c5-b11c-1968459a6306","resolution":{"observed_at":"2026-05-11T06:51:52.592824Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":"2406.08413","doi":"10.48550/arxiv.2406.08413","metadata_source":"pith","pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory is all you need: An overview of compute- in-memory architectures for accelerating large language model inference.arXiv preprint arXiv:2406.08413","venue":"cs.AR","work_id":"c0b3a041-7a1b-45ca-8530-dd2ee8602a04","year":2024},"citing_paper":{"arxiv_id":"2604.09590","last_updated":"2026-03-03T09:02:17Z","snapshot_observed_at":"2026-07-06T22:58:25.877654Z","submitted_at":"2026-03-03T09:02:17Z","title":"DeepReviewer 2.0: A Traceable Agentic System for Auditable Scientific Peer Review","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T17:19:38.627340Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2604.09590"},"observation_digest":"sha256:4cd2a1690c360a93586ddaaaeb6ce973f3ee219498dae870ef0bd7e4bab40c9f","observation_id":"2330c259-9e30-400e-a8b6-b545bde908bf","resolution":{"observed_at":"2026-05-15T17:20:10.420212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":"2406.08413","doi":"10.48550/arxiv.2406.08413","metadata_source":"pith","pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory is all you need: An overview of compute- in-memory architectures for accelerating large language model inference.arXiv preprint arXiv:2406.08413","venue":"cs.AR","work_id":"c0b3a041-7a1b-45ca-8530-dd2ee8602a04","year":2024},"citing_paper":{"arxiv_id":"2604.26074","last_updated":"2026-04-28T19:30:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-28T19:30:47Z","title":"DAK: Direct-Access-Enabled GPU Memory Offloading with Optimal Efficiency for LLM Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-07T15:00:23.910898Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2604.26074"},"observation_digest":"sha256:cfdea760ed4bc2e523a29c20a5cf8121c3d29074ff94a3fc6a2656505af09139","observation_id":"64964b89-24e6-4add-85cb-beaf12876fe7","resolution":{"observed_at":"2026-05-12T00:36:13.817928Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":"2406.08413","doi":"10.48550/arxiv.2406.08413","metadata_source":"pith","pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory is all you need: An overview of compute- in-memory architectures for accelerating large language model inference.arXiv preprint arXiv:2406.08413","venue":"cs.AR","work_id":"c0b3a041-7a1b-45ca-8530-dd2ee8602a04","year":2024},"citing_paper":{"arxiv_id":"2605.00544","last_updated":"2026-05-01T09:51:04Z","snapshot_observed_at":"2026-07-06T23:13:57.367556Z","submitted_at":"2026-05-01T09:51:04Z","title":"An Unsupervised Machine Learning-based Framework for Wafer Scale Variability Analysis and Performance Prediction of Ferroelectric Hf0.5Zr0.5O2 Thin Film Capacitors","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-09T18:45:07.928250Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2605.00544"},"observation_digest":"sha256:ebf16bbee3d4850875c27d153aa466f7c73b36b9760ac4e5b0ed6349f276632f","observation_id":"1267c1f8-d439-4c7e-8c2c-06081dfb7530","resolution":{"observed_at":"2026-05-09T19:05:10.899003Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":"2406.08413","doi":"10.48550/arxiv.2406.08413","metadata_source":"pith","pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory is all you need: An overview of compute- in-memory architectures for accelerating large language model inference.arXiv preprint arXiv:2406.08413","venue":"cs.AR","work_id":"c0b3a041-7a1b-45ca-8530-dd2ee8602a04","year":2024},"citing_paper":{"arxiv_id":"2605.26555","last_updated":"2026-05-26T05:10:16Z","snapshot_observed_at":"2026-07-06T23:36:25.432687Z","submitted_at":"2026-05-26T05:10:16Z","title":"Chips in the Flatland : 2D Semiconductors for Future Computing Electronic","version":1},"reference_index":156,"source":"pdf_text","source_observed_at":"2026-06-29T15:00:44.107706Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2605.26555"},"observation_digest":"sha256:09a0c293824d2ab37c09064b2a8ba2fb42e552f5bc098189843f9058dff10103","observation_id":"12f72179-af77-4f6b-9d36-e39beb185883","resolution":{"observed_at":"2026-06-29T15:03:31.523454Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":"2406.08413","doi":"10.48550/arxiv.2406.08413","metadata_source":"pith","pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory is all you need: An overview of compute- in-memory architectures for accelerating large language model inference.arXiv preprint arXiv:2406.08413","venue":"cs.AR","work_id":"c0b3a041-7a1b-45ca-8530-dd2ee8602a04","year":2024},"citing_paper":{"arxiv_id":"2606.00288","last_updated":"2026-06-24T07:36:07Z","snapshot_observed_at":"2026-07-06T23:41:01.066075Z","submitted_at":"2026-05-29T19:20:16Z","title":"Model-Native Computing Architecture: Envisioning Future System Architecture Through the Lens of Computer Architecture","version":3},"reference_index":158,"source":"pdf_text","source_observed_at":"2026-06-28T22:12:13.114405Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2606.00288"},"observation_digest":"sha256:16b7ae5486c23b8ad2f4187bae9cbc79940ea0f166a2acf92e27606926a89cc9","observation_id":"9a9b0409-9c6a-4964-a33a-41a325ab2c7f","resolution":{"observed_at":"2026-07-01T19:36:09.333689Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":"2406.08413","doi":"10.48550/arxiv.2406.08413","metadata_source":"pith","pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory is all you need: An overview of compute- in-memory architectures for accelerating large language model inference.arXiv preprint arXiv:2406.08413","venue":"cs.AR","work_id":"c0b3a041-7a1b-45ca-8530-dd2ee8602a04","year":2024},"citing_paper":{"arxiv_id":"2607.08196","last_updated":"2026-07-09T07:54:39Z","snapshot_observed_at":"2026-08-07T00:25:36.849231Z","submitted_at":"2026-07-09T07:54:39Z","title":"A First-Principles Theory of Slow Thinking and Active Perception","version":1},"reference_index":172,"source":"pdf_text","source_observed_at":"2026-07-10T11:32:24.374377Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2607.08196"},"observation_digest":"sha256:6d874ff550ede580bdfd72c5733a62af5bbb3e5832d30bf46aa0c37079baa5fa","observation_id":"f5f0d840-1189-45e3-9e9f-c8d0483b8b74","resolution":{"observed_at":"2026-07-10T11:37:03.314288Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-07-14T06:16:09.070414Z","title":"arXiv preprint arXiv:2406.08413 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11211","last_updated":"2026-07-13T08:02:26Z","snapshot_observed_at":"2026-08-06T02:13:21.548625Z","submitted_at":"2026-07-13T08:02:26Z","title":"FastTPS: An Optimized Method for LLM Token Phase for AI accelerators","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-14T06:16:09.070414Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2607.11211"},"observation_digest":"sha256:599b584985b6207a7561a12ac194cbe8c9cfa31aa7e13b95092a81fa84ebcf9a","observation_id":"930db989-f3df-49a3-b003-3ef3e440f69a","resolution":{"observed_at":"2026-07-14T06:16:09.070414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-08-05T17:14:17.119250Z","title":"Memory is all you need: An overview of compute-in-memory architectures for acceler- ating large language model inference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03537","last_updated":"2026-08-04T12:15:28Z","snapshot_observed_at":"2026-08-08T13:01:29.834444Z","submitted_at":"2026-08-04T12:15:28Z","title":"ComFuse: Fusing Complex Memory-Intensive Subgraphs with Compute-Intensive Kernels For Modern GPU Architectures","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T17:14:17.119250Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2608.03537"},"observation_digest":"sha256:77dcf6a53f1992cf456b8984c86d695f8374d1e377a6fee3f834e388ece646aa","observation_id":"f6f83c22-51b8-4517-8890-71eb6f4cf4a1","resolution":{"observed_at":"2026-08-05T17:14:17.119250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.08413/citation-record","integrity":"/paper/2406.08413/integrity","json":"/paper/2406.08413/citation-record.json","paper":"/paper/2406.08413"},"outbound":[],"paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","latest_version":1,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2406.08413."}