{"as_of":"2026-08-10T13:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5508019dcffa435961eae4034c48e19b2480148462460ee9683666b1de2da919","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T06:26:59.984686Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:50:52.423769Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T21:50:53.152351Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"cited_work":{"arxiv_id":"2606.22968","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.22968","snapshot_observed_at":"2026-08-05T21:50:53.152351Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","venue":"cs.AR","work_id":"b0907f56-821f-407c-b5c4-0843fa9eb941","year":2026},"citing_paper":{"arxiv_id":"2608.03285","last_updated":"2026-08-04T08:00:29Z","snapshot_observed_at":"2026-08-07T23:10:51.573182Z","submitted_at":"2026-08-04T08:00:29Z","title":"Fovea: Physical-Implication-Aware Wafer-Scale DSE with Decision-Domain-Guided Cross-Fidelity Refinement","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T21:50:52.423769Z"},"links":{"cited_paper":"/paper/2606.22968","citing_paper":"/paper/2608.03285"},"observation_digest":"sha256:26bc5aa21eb66b9ab4854e0ef4b904181accf77d935c2d5f1e72451ed2069994","observation_id":"bf743749-c279-458f-b368-5f66ec08a8f6","resolution":{"observed_at":"2026-08-05T21:50:53.247085Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.22968/citation-record","integrity":"/paper/2606.22968/integrity","json":"/paper/2606.22968/citation-record.json","paper":"/paper/2606.22968"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: Proceedings of the ACM SIGOPS 31st Symposium on Operating Systems Princi- ples","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:c799e67e64ddda31941045390e7d3dcc2541b50ef525c80f6fe6f449d29ab8c9","observation_id":"f5c072c1-75e7-4512-bfbd-b2215cd3feb2","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03868","last_updated":"2024-06-06T08:55:01Z","snapshot_observed_at":"2026-08-09T01:11:50.814166Z","submitted_at":"2024-06-06T08:55:01Z","title":"PALM: A Efficient Performance Simulator for Tiled Accelerators with Large-scale Model Training","version":1},"cited_work":{"arxiv_id":"2406.03868","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.03868","snapshot_observed_at":"2026-07-04T12:39:49.228101Z","title":"arXiv preprint arXiv:2406.03868 (2024)","venue":null,"work_id":"01375976-4f8b-4fa1-af51-c2579ed2625f","year":2024},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"cited_paper":"/paper/2406.03868","citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:aff75b586d014bbe1d02c60a68902f455971b833e1c23855883c08e548d1319e","observation_id":"3c903882-7d1c-40c9-a29e-71ccea2f3404","resolution":{"observed_at":"2026-07-04T12:39:49.229562Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04563","last_updated":"2025-05-30T12:10:19Z","snapshot_observed_at":"2026-08-09T14:34:26.825396Z","submitted_at":"2025-02-06T23:32:19Z","title":"WaferLLM: Large Language Model Inference at Wafer Scale","version":3},"cited_work":{"arxiv_id":"2502.04563","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04563","snapshot_observed_at":"2026-07-04T12:39:49.219978Z","title":"arXiv preprint arXiv:2502.04563 (2025)","venue":null,"work_id":"7159ee61-6219-4b7e-892c-1ef836220b5b","year":2025},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"cited_paper":"/paper/2502.04563","citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:766d0398b1afd39590313ec2ce01bfabdc8af9f4b8fc3281c3a8f9fb6422c85a","observation_id":"602676aa-5bc4-4c26-8bcc-5f0d44667e6a","resolution":{"observed_at":"2026-07-04T12:39:49.221490Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"IEEE Circuits and Systems Magazine24(1), 52–81 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:c3b595e29b3e96c0a6a042f52adbe4c188a461849e9739e4bec2fbdeec9fc2de","observation_id":"b3d1d655-9327-42bd-80dc-dfed180bc5e1","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"Advances in neural information processing systems32(2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:912ea9183a1515bc13e799c173b0aa03311f2dc826de0266770d544e0fc965d4","observation_id":"d6613e2b-d9cd-49a9-b647-bb700e1331a1","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:1eb23419e52de2c73f0de120d14c1def1b4f24d27183632d0139a76ea6cb6359","observation_id":"0f2b4e95-6100-406f-8ccc-1b177cafbf21","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"IEEE Transactions on Circuits and Systems I: Regular Papers (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:b0508bea50fb02970ba08d7f3830af396f6686f32189174fd39b84b4fd03d0d3","observation_id":"5caec8c2-7734-47b9-8182-331c074a4dd4","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2026 IEEE International Symposium on High Performance Computer Architecture (HPCA)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:02c4c39bfad7fb6e7c54790834245ac5d6587bdb7fbfd5a377a096d1fbbb10aa","observation_id":"7fa9a676-78f2-480b-9f1c-49e941086941","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:d4ebc51ae1bc2e92e761e130a120faf7a3dbd7df1f4f143852b59af30a8e3901","observation_id":"3d7f6b93-684b-4256-bb98-452874fd9810","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2022 IEEE Hot Chips 34 Symposium (HCS)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:121a98d3975fea3b6918d603ec1a288de94ccb0e7179e2c04f33d5d937f75175","observation_id":"eafb6db0-1498-427f-87fb-f7cded1c0970","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: Proceedings of the 31st ACM International Conference on Architectural Support for Programming Languages and Operating Systems, Volume 2","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:abfd16be1ad324685ada8c563c6e54341101bc91eebf786f4df770fbf0b74206","observation_id":"dff5c0af-e544-4e65-942f-3a8b60470d05","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: MICRO- 54: 54th Annual IEEE/ACM International Symposium on Microarchitecture","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:ce92838539be7e0837c1700d72e284255d03a541810098c4f5dab6d379b5f579","observation_id":"596d0626-2518-4580-89a5-88a6927d6dea","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"Available:https://huggingface.co/ meta-llama/Meta-Llama-3-70B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:5cfbd494f76ab5073012e19b18940634967a36f103e3d4613caa085993a6b695","observation_id":"29156ffe-abd8-4ed3-baac-635d78816ba5","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"Available:https://huggingface.co/ meta-llama/Llama-3.1-405B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:ee9250f2eec08f010709c8d5415662161032635ebe3065878cc97d4dfd487d4e","observation_id":"14bd7cb1-7db7-4994-b834-9d26d93a1def","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"Available:https:// huggingface.co/mistralai/Mistral-Large-Instruct-2407","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:6003e1306606cf7edd073d4133807a1eba95864b665b602f95bc62f61da13e16","observation_id":"fed372b1-01c3-46c5-8485-d5c14ac56b01","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2025 IEEE International Solid-State Circuits Conference (ISSCC)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:34cda36d323f37d0e9adca9af1759ae3a4e9a207666308d4fbe00b799c8f3b94","observation_id":"93d7c482-393c-4c02-a56f-dc743b43ac55","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"Available:https: //www.nvidia.com/en-us/data-center/dgx-vera-rubin-nvl72/","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:67510306f64c036533144b7f3585c85cc7865d3161065e6b122357a2800867f6","observation_id":"beba5489-f8ef-4b14-a692-d0bcb33bc3d3","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2021 58th ACM/IEEE Design Au- tomation Conference (DAC)","venue":null,"work_id":null,"year":2048},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:a2edc8768711093b0ca43e7c3d0cacc548dc5b70eab6cb5c5c881c6767196ef0","observation_id":"0631fbe1-3e0d-4ebe-b4f9-63aaa3889ac9","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"Available:https://huggingface.co/ Qwen/Qwen3-235B-A22B","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:c7aa1b729d3c2e9058499858de94d68398520b4aca9fc7c252635ef8d2c98cc5","observation_id":"401496bc-e95e-4904-aa2b-663a4cd8f246","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19580","last_updated":"2025-06-09T06:50:50Z","snapshot_observed_at":"2026-07-06T18:38:13.900206Z","submitted_at":"2024-06-28T00:05:53Z","title":"FRED: Flexible REduction-Distribution Interconnect and Communication Implementation for Wafer-Scale Distributed Training of DNN Models","version":2},"cited_work":{"arxiv_id":"2406.19580","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.19580","snapshot_observed_at":"2026-07-04T12:39:49.222558Z","title":"arXiv preprint arXiv:2406.19580 (2024)","venue":null,"work_id":"20fac41b-61a7-4c49-bb7a-78f9156ce4df","year":2024},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"cited_paper":"/paper/2406.19580","citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:13f3d74e4a9dbc53e545385a6d9a7630011cf21fce4f9fba93d42ebae1624b9c","observation_id":"33695bc3-cce5-458c-92b8-dd4c5f9b254b","resolution":{"observed_at":"2026-07-04T12:39:49.224227Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2025 IEEE 75th Electronic Components and Technology Conference (ECTC)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:773dd8bf0dae99edb4e986b0cce4a6ae29b1189e50fb2249ff8116c899ac9d17","observation_id":"dc50a940-a137-42c5-b63e-a4fa810d8c0c","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2022 IEEE Hot Chips 34 Symposium (HCS)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:c1dc00ca398ff33d37c117c381f190ee8a2f765300ae05ce68471b4310614769","observation_id":"f620b95b-fd81-483b-ad44-51c53e4b910b","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2026 IEEE International Symposium on High Performance Computer Architecture (HPCA)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:7d6b1a7fa3d77184c505cabb5ea2fe2aaffcfc30f515aaf3b061db0edc28dee1","observation_id":"772081c9-eda1-4864-aef6-a541546c88ce","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2024 57th IEEE/ACM International Symposium on Microarchitecture (MICRO)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:f266ace75d8a629a8abe39d6c5157e231cd9b6f7c116c573e9d82b42b50ded1d","observation_id":"e648af3f-22d2-44a6-9ae5-02770a8f47c7","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2026 IEEE International Symposium on High Performance Computer Archi- tecture (HPCA)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:e8f01f459df795e30dca819f2d07455a6665e4bd1e2e59d90f0eaca8c612852d","observation_id":"5d3f9e29-bcf8-4592-8f29-effd411b7a41","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2026 31st Asia and South Pacific Design Automation Conference (ASP-DAC)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:20e4e7d92c9ffdfa3cdda3b97e4ec193e062e44394b22b97b6ee4c48b2639820","observation_id":"73ec4013-42fc-4d03-8370-d3288ca9598e","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2026 31st Asia and South Pacific Design Automation Conference (ASP-DAC)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:32ee33f2a166e2de4d85035ce480458c966fe1cd428004366fd22fca2adad3fb","observation_id":"16a0cd12-b6e8-4f1a-a423-5a1ff96e7e2c","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"IEEE Transactions on Circuits and Systems II: Express Briefs (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:1caa95ad96e251449d877424517802502c8afb2c0bbe135d59dfa6f1712461cd","observation_id":"4b73cca2-eda6-4b8b-812d-6f790403cf6a","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2026 IEEE International Symposium on High Performance Computer Architec- ture (HPCA)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:ffbacd4510793a2b6849161957a27e7a802d36419aa6f56e909753be45855d12","observation_id":"3957f69e-8ab1-479c-8c89-fbc4191dad97","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: Proceedings of the 58th IEEE/ACM International Sympo- sium on Microarchitecture®","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:288d86a166ddd925beba0492ab698637a5e808df4c99b0bba411212a958208f8","observation_id":"319349cc-9f56-496a-a0e0-3080260f8e01","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"IEEE Transactions on Computers (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:8a73ec3223e7cb9cb9d89bf4ebe87f421adcbee26155139c24bc1c77cd07df1a","observation_id":"10889604-f3bc-4691-9620-bc8bce6011b8","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2026 IEEE International Symposium on High Performance Computer Archi- tecture (HPCA)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:0e8b9a12f55e32dd10a7b7b87118241b804c3411e04411d3b963f8fd5c463fd7","observation_id":"7bb9adf0-b040-4b11-9a78-7a4907146791","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"Integrated Circuits and Systems (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:e853371195a6544e455e1f560fe905ec6e3e9fc5cec7148bc0c7c56257f08fe4","observation_id":"ee4ada80-d1c6-4bd5-8520-86dda3b0e0eb","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: International Symposium on Advanced Parallel Processing Technologies","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:a12755f0d97b2ba8cc8c213faee61e1713dece861ddb5b5762cfee7d63c68488","observation_id":"76e6d9c9-f885-4dfc-93d7-ba34183d1bcb","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"0: Modeling hierarchical networks and disaggregated systems for large-model training at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:ecc229b3f529a7a003fe30266697f0535cd89e5bfa36829b75dd1cc6b3bab263","observation_id":"33767e4d-b606-4112-850a-b75b61cfe5c3","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2026 IEEE International Symposium on High Performance Computer Architecture (HPCA)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:d93137607f2b35c9eb73e5a272abf08fa576ec764fdf8f177fdcbdf118509d96","observation_id":"7f0888e5-64e8-47f4-8fb9-37572d4da2ae","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: Proceedings of the 52nd Annual International Symposium on Computer Architecture","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:6a4db58f55d8b2921fcb638271efb9753f3509be9cc68796425cb1b57b2384d1","observation_id":"914ddad4-90e7-4f50-9be4-922d31ddf8c5","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: Proceedings of the 52nd Annual International Symposium on Computer Architecture","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:8453df95512e6fcb8e5518a1b0ea3911888fa3eee5297f26231a9ec31beb6c4b","observation_id":"1dbbde5a-4c66-40ae-b34d-002223acfc42","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"In: 2024ACM/IEEE51stAnnualInternationalSymposiumonComputerArchitecture (ISCA)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:371910dc0478d63729c2236bac032c077f66621683a7436906dacdcfc56417fe","observation_id":"90eb2d0a-6f13-4e59-b25b-7b6fef49c927","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17152","last_updated":"2024-05-06T02:05:45Z","snapshot_observed_at":"2026-08-10T13:07:04.859020Z","submitted_at":"2024-02-27T02:37:37Z","title":"Actions Speak Louder than Words: Trillion-Parameter Sequential Transducers for Generative Recommendations","version":3},"cited_work":{"arxiv_id":"2402.17152","doi":"10.48550/arxiv.2402.17152","metadata_source":"pith","pith_arxiv_id":"2402.17152","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Actions Speak Louder than Words: Trillion-Parameter Sequential Transducers for Generative Recommendations","venue":"cs.LG","work_id":"cedb01b6-64b1-4cd7-a797-f157c3dc9930","year":2024},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"cited_paper":"/paper/2402.17152","citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:c5df54757e5e6db0d1d49832099753df90f7a1cc529f75a26157baf7d3dc340a","observation_id":"d90c3a09-fe21-4c5e-ae92-52682c9368e7","resolution":{"observed_at":"2026-07-04T12:39:49.226631Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-08T02:38:06.972573+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T02:38:06.972573+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:26:59.984686Z","title":"IEEE Journal on Emerging and Selected Topics in Circuits and Systems (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-26T06:26:59.984686Z"},"links":{"citing_paper":"/paper/2606.22968"},"observation_digest":"sha256:745033021436039456532a86d7d09b594f004dd3ddec6d8549f82a2e3b547b52","observation_id":"01d4d931-9d62-48fd-bdf1-357c2976cd3f","resolution":{"observed_at":"2026-06-26T06:26:59.984686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.22968","last_updated":"2026-06-22T07:51:15Z","latest_version":1,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-02T07:47:32.272471Z","submitted_at":"2026-06-22T07:51:15Z","title":"MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":37,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 1 inbound Pith citation observation for arXiv:2606.22968."}